網路爬蟲：不生產內容，只是內容的搬運工

2019-03-11 10:41:07 人人都是產品經理

搜索引擎和聚合類新聞App之所以有源源不斷的新內容供予用戶瀏覽，原因就在於有網絡爬蟲技術的加持。網絡爬蟲的應用對於用戶來說，是一大福利——我們可以從一個搜索引擎輕鬆搜索到各個領域的信息。但是，對於原創方來說，就涉及到版權被侵犯的問題了。工具理性，但不意味著操持工具的人就可以假借“工具理性”肆意侵犯他人的合法權益，網絡爬蟲技術的應用還應該要在法理之內。

一、初識爬蟲

工作的時候，想要查找“產品設計”，可以直接在搜索引擎上輸入內容，就可以直接找到數以百萬計的資料。

上下班路上，刷新聞類APP的時候，只要願意，就會有源源不斷的新的信息，足夠刷一路的時間。

搜索引擎和（大多數）新聞類APP都不自己生產內容（雖然有些平臺孵化了自己的內容，但也只佔整個平臺內容的很少的一部分，更重要的是，成本非常高）。

那麼，他們的大量的內容從哪裡來？

“我們不生產內容，只是內容的搬運工”，將互聯網上的內容“搬運”到自己的服務器上，這就是爬蟲。

首先，我們需要了解一下互聯網的結構。

互聯網上的內容數以億計，雖然很複雜，但說白了就是一張大網，網上的每個節點就是一個網頁，連接網頁的超鏈接（Hyperlinks）相當於線，線把所有的節點連接在一起，形成了一個複雜的網。

通過點擊超鏈接的文字或者圖片，就可以跳轉到對應的網頁。爬蟲可以自動訪問到每一個網頁，並把網頁的內容保存下來。

世界上第一個網絡爬蟲由麻省理工學院的學生馬修·格雷（Matthew Gray）在1993年寫成，之後的爬蟲儘管越來越複雜。

比如：可以實現更快的訪問速度、訪問更多的網頁、更好的將網站內容解析出來。但爬蟲的基本原理是一樣的，都主要包括三個部分：訪問網頁鏈接，下載網頁內容，解析網頁內容。

爬蟲的工作過程與我們查找網頁的過程是一樣的。

比如，我們想要查一下豆瓣上最新的電影：首先，在瀏覽器地址欄輸入網址鏈接https://movie.douban.com/，之後，瀏覽器會跳轉到豆瓣電影。最後，我們就可以找到當前熱映的電影。

同樣的，一個最簡單的爬蟲三步就可以爬取一個網頁——首先，訪問這個網頁，之後，把網頁內容下載下來，最後，對下載的內容進行解析。

二、7行代碼爬取豆瓣電影

最簡單的爬蟲三步就可以爬取一個網頁，那麼要寫多少行代碼呢？

我們寫一個爬蟲，爬取豆瓣的“一週口碑榜”，只要7行代碼！

這裡我們使用Python語言，至於為什麼選擇Python語言，會在後面交代清楚，如果不懂Python也沒有關係，瞭解爬蟲是如何工作的就可以了。

代碼如下：

import requests from lxml

import html url=’https://movie.douban.com/’ # 1、需要爬數據的網址

page=requests.Session.get(url) # 2、訪問網頁

tree=html.fromstring(page.text) # 3、解析網頁的過程

result=tree.xpath(‘//td[@class=”title”]//a/text’) #3、解析網頁的過程

print(result) # 打印出結果

在Python環境中運行這幾行代碼，就可以獲取“一週口碑榜”了，結果如下：

[‘迦百農’, ‘綠皮書’, ‘馴龍高手3’, ‘速成家庭’, ‘阿麗塔：戰鬥天使’, ‘膚色’, ‘死亡天使’, ‘黎明牆’, ‘小小巨人’, ‘出·路’]

其中最關鍵的是解析網頁內容，主要是(‘//td[@class=”title”]//a/text’)這行代碼，大多數人可能對比較困惑。

這涉及到HTML網頁的結構，可以把網頁理解成一個文件夾，打開一個文件夾，會發現子文件夾，子文件夾或許還有文件夾。通過打開一個個文件夾，最終找到需要的數據。

//td ：這個相當於大目錄；
[@class=”title”]：這個相當於小目錄；
//a ：這個相當於最小的目錄；
/text：這個是提取其中的文字內容。

至於是怎麼寫出來這行代碼的，可以通過在網頁空白處點擊右鍵，查看源代碼，就可以找到對應的td、class=”title”、a等標識符。

大多數程序員寫爬蟲選擇python的理由很簡單.

首先，python有很多的庫，可以直接調用，比如：上面的代碼就引入了requests、lxml庫，分別實現訪問網頁、對網頁結構解析。有開源的庫，就直接調用，避免重複造輪子。

其次，python寫起來很方便，配置也簡單，短短几行的代碼，就可以直接運行了，如果使用C或者Java，可能配置環境就要老半天。

三、一個簡答的爬蟲系統

把上面的每個步驟分別實現（模塊化），就可以構成一個簡答的爬蟲系統。

使用URL（可以理解為網址鏈接）管理器管理所有的網址鏈接，使用HTML（可以理解為網頁內容）下載器下載網頁內容，使用HTML解析器對下載的內容解析，再加上數據存儲模塊、控制整個爬蟲的調度模塊，就構成了一個簡單的爬蟲系統。

爬蟲基本架構

更具體的說，URL管理器負責管理所有的網址鏈接，記錄下哪些URL已經爬取了，哪些還沒有爬取。如果爬取過了，就要避免再次下載，如果沒有，就要加入隊列，等HTML下載器下載。

HTML下載器可以從服務器下載整個網頁的內容，從URL管理器中獲取未爬取的網址鏈接，之後，訪問這些網頁鏈接，下載網頁。

HTML解析器負責解析下載好的網頁，主要有兩個任務：一方面，解析出需要的信息，比如上文的“一週口碑榜”；另一方面，解析出新的URL鏈接，交給URL管理器，繼續下載，這個功能在上面的“7行代碼”沒有實現。

數據存儲器實現存儲數據的功能，將HTML解析器解析出來的信息存儲起來，否則每次使用都要下載，會浪費大量的時間。圖片、文檔之類的文件可以直接保存到服務器上，文字類的可以通過數據庫存儲起來。

爬蟲調度器作為系統的大腦，負責統籌其他四個模塊的協調工作。

無論是大型的還是小型的爬蟲雖然在設計細節，性能上有所不同，但都不會脫離這五個模塊。

四、更深入的考慮

乍一看，每個模塊實現起來都很簡單，但細想，似乎每個模塊都要考慮很多東西。

1. 初始的網址鏈接如何獲得

7行代碼爬取豆瓣電影，直接訪問網址鏈接（https://movie.douban.com/）就可以爬取“一週口碑榜”。對稍大一些的爬蟲系統或者商用爬蟲，就要有更多的考慮了，在保證獲取充足信息的同時，也要保證下載的質量。

對搜索引擎公司而言，要儘可能包括互聯網所有的信息。對垂直領域，更多的偏向業務類信息，比如：對新聞類的APP，主要包括一些新聞網站、政府網站等，對Github這類的編程網站，他們可能就不感興趣。

巧婦難為無米之炊，初始的網址鏈接基本要靠人工憑經驗獲取，比如：新聞類的APP，他們的初始URL列表裡可能就包括新浪、網易、搜狐等門戶網站，也包括各個級別的政府網站，還有人民網、新華社、人民日報等媒體的網站。

2. 如何確定哪些網頁已經下載過了

當一個頁面下載完成後，從這個網頁中提取出其中的網址鏈接，把它們添加到等待下載的隊列中，就可以獲得更多的網址鏈接。

如果一個網頁已經下載過了，重新下載，會消耗大量的時間，並佔用存儲空間。更要命的是，如果一直重複下載，就可能陷入死循環。

那麼，如何知道這網址鏈接是不是已經下載過了？

對於小型爬蟲，可以使用列表存儲下載過的網址鏈接，當有新的網址鏈接的時候，先查找這個列表中有沒有該網址鏈接。如果有的話，就不用插入，如果沒有的話，就插入列表，等待訪問下載。

對於大型爬蟲，有成百上千個“小爬蟲”（更加專業的名詞叫做分佈式爬蟲），分佈在不同的服務器上，同時爬取網址鏈接，就要考慮更多的東西。

比如：不同爬蟲之間的分工和通信，如何共同維護上述的列表。

當數據很大的時候，就要考慮分佈式、通信、存儲、帶寬等每個環節的限制，無論哪個環節沒有做好，都有可能成為系統的瓶頸，這就像是木桶效應中的短板。

數據量增加10倍，之前的代碼可能要重寫了，工作量可能就要增加100倍，這也是量變引起質量的一個很好的例子。

在計算機領域，這樣的例子隨處可見，當數據增大到一定量級，原有的算法很可能無法繼續使用，需要重新開發，隨之而來的是加班、DEBUG以及延期上線。

3. 頁面的解析

爬取豆瓣電影的“一週口碑榜”，需要研究網頁的源代碼，並編寫對應的解析代碼。但是網頁的結構不同，用這個代碼爬取知乎，解析不到任何內容。

以新聞類的APP為例：一個好的新聞類APP需要爬蟲數以億計的網頁，並把裡面的文字、視頻、圖片分別解析出來，難度可想而知。

好消息是一部分網站會遵守RSS規範（遵守RSS規範的網頁結構和代碼都有相似性，以便於訂閱器獲取主要信息），一種類型的爬蟲就可以爬取大量這種類似的網頁。但大部分的網站的結構，都是不同的，這需要算法工程師花費大量的時間和精力做解析工作。

五、反爬蟲

新聞類APP通過爬蟲，獲得大量的優質資源，讀者也樂意在一個平臺上看到所有的內容，但“被爬取”的網站就不太高興了。對於大多數依靠廣告收入的網站，沒有了流量，連生存都成了問題，更別說盈利了。

一些自成體系的平臺，比如：大型電商平臺，他們希望所有的用戶在自己的平臺上查找信息，所有的商家在自己的平臺上吸引賣家（廣告費可不能付給搜索引擎），同樣不希望爬蟲的騷擾。

搜索引擎希望爬取更多的信息，優質的內容提供商又不希望被爬蟲騷擾，利益衝突難以調和，於是產生了Robots協議來解決這個問題。

Robots協議網站服務器的一個聲明，通常是保存在網站根目錄下的一個TXT格式的文件，網站通過Robots協議告訴搜索引擎：哪些頁面可以抓取？哪些頁面不能抓取？

當爬蟲訪問一個站點時，它會首先檢查該站點根目錄下是否存在robots.txt，如果存在，爬蟲就會按照該文件中的內容來確定訪問的範圍；如果該文件不存在，所有的爬蟲將能夠訪問網站上所有沒有被口令保護的頁面。

我們使用搜索引擎，經常會看到“由於該網站的robots.txt文件存在限制指令（限制搜索引擎抓取），系統無法提供該頁面的內容描述”，就是源於這個協議。

值得注意的是：Robots協議是國際互聯網界通行的道德規範，並沒有強制性約束力。

一些“沒有道德”的爬蟲同樣會爬取有robots.txt限制指令的網站，這時候就需要一些技術來實現反爬蟲了。

最常見的有三種方式：

1. 網站會根據IP地址訪問的頻率確定是不是爬蟲

每個電腦都有唯一的IP地址，每個爬蟲也有唯一的IP地址，當電腦或者爬蟲訪問網站的時候，網站會記錄這個IP地址。如果同一個IP短時間多次訪問同一個網站，這個網站可能會傾向於認為這是個爬蟲，會採取一些措施。

當然，這在反爬蟲的同時，也會給用戶帶來一些不好的體驗。

相比之下，一些比較優秀的網站或者APP，會根據用戶點擊頻率、時間間隔等信息，判斷是不是爬蟲或者誤點擊，之後再確定是否需要驗證。

更好的用戶體驗背後，是更大的開發成本，更長的開發週期。

2. 網站也可以根據用戶請求的Headers來判斷是不是爬蟲

當我們使用瀏覽器訪問網站的時候，瀏覽器會自動在訪問請求上添加一些信息，比如：瀏覽器採用的編碼方式、使用的操作系統、瀏覽器版本等信息放在訪問請求的最開始，作為Headers，但爬蟲一般不會附加這些信息。

網站會根據是否存在Headers信息以及Headers信息的內容，判斷對方是不是爬蟲，有必要的話，就拒絕訪問。

3. 動態頁面的反爬蟲

之前將的HTML網頁都是靜態的，隨著HTML代碼生成，頁面的內容和顯示效果就不會發生變化了。而動態網頁則不然，動態網站是腳本語言（比如PHP）生成的，一些內容不是直接可見的，而是要運行一些腳本，才能看到。

網址後綴為htm、html、shtml、xml的網頁是靜態網頁，而動態網頁是以·aspx、.asp、.jsp、.php、.perl、.cgi等形式為後綴，並且在動態網頁網址中有一個標誌性的符號“?”，這些不同的後綴基本代表了網頁使用的語言。

訪問靜態網頁，只需要直接訪問鏈接就可以了，訪問動態網站，還需要執行一些特定的操作（比如點擊），才能顯示更多的內容，這就增加了爬取的難度，一些簡單的爬蟲就被拒之門外了。

介紹完三種主流的反爬蟲的方式，最後要說的是：反爬蟲技術也不是一勞永逸的，在反爬蟲的發展過程中，爬蟲也進化出了一系列反“反爬蟲”的方式。

針對反爬蟲驗證IP機制，爬蟲“進化”出了IP代理池，這樣，爬蟲就可以不斷變換自己的IP地址，迷惑反爬蟲。針對Headers驗證，爬蟲也會生成一個Headers信息，甚至針對動態頁面，也會模擬瀏覽器的行為。

雖然如此，反爬蟲在一定程度上提高了爬蟲的成本，降低了爬蟲的效率，就可以將一大部分爬蟲擋在門外。

從爬蟲與反爬蟲的例子也可以看出：大多數時候，沒有絕對的有效方式。提高對方的成本，讓對方覺得代價太大，得不償失，就是很好的解決問題的辦法。

六、爬蟲實現冷啟動——勝利即正義？

上面講了爬蟲是怎麼運行的，常見的反爬蟲機制。最後，我們再講一個爬蟲的應用場景的例子，可以幫助我們更好理解爬蟲。

冷啟動是每一個產品經理、運營人員和創業者面臨的重大問題。沒有優質的內容，就吸引不了用戶，沒有大量的用戶，就無法吸引優質的內容，就陷入了先有雞還是先有蛋的悖論。

爬蟲，低成本、快速地解決了這個問題！

“我們不生產新聞，我們只是新聞的搬運工”，通過爬蟲，低成本、快速地爬取整個互聯網的優質內容，並憑藉海量數據，利用算法實現內容分類和個性推薦（個性推薦系統會在後序章節詳細介紹），吸引大量的用戶，最終通過廣告變現。

事實證明，這是個非常成功的商業模式。而媒體平臺和新聞網站僱傭大量編輯人員，花費大量時間、金錢寫成的高質量內容，連說一聲都沒有，就這樣被拿走了，這不是侵犯人家版權嘛！

於是，多家媒體聯合發起侵權訴訟或抗議聲討，最終迫使這家新聞巨頭支付版權費，但無論法律上、道德上有多少問題，都不影響這家公司商業成功的既定事實。

類似的事情同樣發生在其他垂直領域。

一家新成立的技術博客平臺，爬取競爭對手上的文章，迅速實現優質內容的聚合。如果原博客主發現了自己的文章被盜用了，新的平臺就移交賬號並看情況給予少許補償。如果對方不樂意，就註銷賬號，當一切都沒有發生過。憑藉這種運營方式，順利實現了冷啟動。

短視頻APP的後來者，也可以通過類似的方式，實現用戶的積累和優質內容的聚合。

勝利即正義？

這似乎是過於武斷的一個評價。

上述的視頻APP做得太過分，引起公憤，最終不得不關閉自己的平臺。

對於通過爬蟲獲取內容的平臺而言，內容的獲取也只是萬里長征的第一步，通過運營手段減小生產內容的成本，通過利益共享激勵優質內容的產生，通過技術減小信息成本吸引用戶，更加任重而道遠。

而版權，也始終是懸於頭頂的達摩克利斯之劍。

題圖來自Unsplash, 基於CC0協議

分享到:

閱讀更多 人人都是產品經理 的文章

關鍵字: 網址搜索引擎內容

小米太無恥了。

小米高管不只口嗨了，在國內拳打友商，在國外卻開始下跪了。下一步，我猜小米會喊，高通爸爸，人家愛死你了，人家已經五體投地了喲。

蹭熱點！說說我理解的手機包裝盒事件。

今早醒來刷頭條，發現大批米系自媒體鋪天蓋地發文嘲諷華為系自媒體，忍不住好奇瞭解了一下情況，原來是剛發佈的一加8 海外版手機的手機包裝盒上面印了一句話:with easy access to the Google apps you use most.而這句話也印在前段時間發佈的小

蘋果公司正式發佈iPhone SE二代手機

新品名為“iPhoneSE”，擁有跟iPhone 8相似的外觀，搭載了蘋果當前最新的A13仿生芯片，具備IP67級別防水防塵能力，配備4.7英寸LCD材質屏幕，支持原彩顯示，配備了Touch ID指紋識別。

華為河圖、麒麟芯片和鴻蒙OS三駕馬車並行？華為生態建設佈局深遠

至於受很多人關注的華為河圖全面落地問題，官方有消息稱，2020年第二季度會提供100個華為河圖測試點，測試點到第四季度會增加至1000個，測試覆蓋空間包括智慧園區、旅遊景點、高鐵站和機場等。

小米高管表示，四千毫安時 5G 手機，和三千多毫安時 4G 手機一樣

小米科技高管盧偉冰在近日表示，5G旗艦手機如果5G網絡全開，功耗會比4G手機高20%，4000mAh的5G手機大約等於4G手機的3200mAH；今年Redmi堅持把5G手機的容量控制在4500mAh以上，也是考慮到5G網絡耗電大的原因，今年很多5G智能手機均採用大電池的設計。

5G畫風變了：麒麟985落地首跑，榮耀坐上開往高端的「地鐵」

榮耀30Pro/30 Pro+同時搭載麒麟990 5G SoC，相應的其它配置更高：Wi-Fi6+，支持紅外遙控，USB 3.0 Type-C接口。

旗艦手機標配Wifi 6 換Wifi 6路由器的時機到了嗎？

現在，家庭寬帶都在500M左右，大部分手機也不支持Wifi6標準，換Wifi 6無線路由器有點早，因為換了Wifi 6無線路由器網速也不會變快。

2020年5G手機賣不動？繼蘋果砍單25%之後，華為小米紛紛跟砍？

都說蘋果手機賣不動了，可我看想買iPhone手機的人還是那麼多，不然之前蘋果公司怎麼會限購？數據顯示，3月份在國內的 iPhone 銷量比 2 月份激增 416%，達到約 250 萬部。

幹翻華為P40系列榮耀30也玩中

而今天的華為發佈會上，榮耀30、30 Pro、30 Pro +3個版本中、大、特大杯齊亮相，又一片全新5G SOC，麒麟985也要登場。

程序員辭互聯網工作，跨行傳統上市公司，上班第1天就蒙了

原來男子是從事互聯網工作，後面覺得是互聯網寒冬來了，就堅決辭去互聯網工作，跨行選擇了一個教育傳統上市公司，可是第1天上班就蒙了，公司讓做的活兒太死板了，沒有發揮空間，同事一點都不友善，領導不放權，而且管理線超級單一，氛圍一點都不一樣，所以想離職。

蘋果發佈新款iPhoneSE，3299元起售

北京時間4月15日晚，蘋果正式發佈了新款iPhone SE，搭載了A13仿生芯片，支持最新的iOS 13系統，支持 18W快充，也支持Qi無線充電。SE機型蘋果到目前為止只發布了兩款，這是iPhone產品體系裡小屏和低價的典型機器。

我很糾結：我究竟適不適合做亞馬遜電商？看了這三條你就知道了

請仔細閱讀，關於跨境電商你想知道的都在這兒

政府對於跨境電商行業的大力支持給咱們廣大跨境電商賣家吃了一顆“定心丸”。我們所做的跨境電商事業在一定程度上不再是為個人謀利益，而是成為了中國產品走向世界，為國家賺取外匯的主力軍。

騙子手段太“精明”：商家賠了貨物又賠款，亞馬遜平臺騙術大揭祕

在開始文章的乾貨分享之前，先給大家講一個商家被用戶勒索的案例。有一位朋友剛剛加入亞馬遜跨境電商平臺兩個多月，在這期間有位美國用戶在他店鋪裡面購買了一個毛巾架。

做跨境電商這麼多年，今天才知道給國外客戶發文件原來這麼簡單

做過跨境電商朋友肯定知道，很多國外客戶對於有些商品看不懂說明書，想索要商品使用視頻教程，畢竟視頻信息量大，容易理解和快速上手。

值得收藏！三類賣家三種選品方案，總有適合你的一個……

網上很多所謂的“大佬”喜歡吹噓用某某工具就可以迅速選品效率，迅速取得很高效率等等，其實這類人就是在賣軟件，收培訓費用…

萬萬沒想到！亞馬遜平臺上面賣床單竟營收一個億！你還在等什麼？

做店鋪這麼多年，今天才知道我的listing突然被封，竟是因為……

亞馬遜小白看過來！請採納這些：亞馬遜選品和運營的小建議

亞馬遜賣家如何爆單？跨境精細化運營攻略必看

不收保證金、入住費、年費，還免三個月佣金，我也想入駐這個平臺

咱們今天不說主打歐美市場的亞馬遜，只談一下以東南亞市場為主的Shopee。好多人都聽說過，但是沒有真正瞭解過，好多人想加入Shopee但是顧慮重重，今天我來給大家普及一下關於Shopee小秘密。

馬雲終於要辭職了，留下的話句句觸動人心

去年，在教師節這天，阿里巴巴集團創始人馬雲今天公開信宣佈：一年後的阿里巴巴20週年之際，即2019年9月10日，也就是今天，他將不再擔任集團董事局主席，卻留下句句觸動心靈的話！！

等等，明年5G手機將迎來大降價

11月26日下午，聯發科技（MediaTek）在深圳舉辦“聯發科技 5G方案發布暨全球合作伙伴大會”，正式發佈了全新的5G新芯片品牌——“天璣”，同時帶來了首款集成式旗艦級5G移動平臺——天璣1000。

微信公開課PRO版2019正在進行時，往屆各自都有什麼黑科技

微信公開課pro版2019，為期兩天微信大會正在廣州火熱進行中，本次會議主題為：同行WITHUS。微信這一款超級應用，已經深入到我們生活的方方面面，所以這48小時的未來盛宴必將吸引無數眼球。

推出「信任分」升級「閃購」，美團本地生活這盤棋有多大？

小海按：美團的超級App夢想更近了？Tech星球文 | 馬微冰陳橋輝頭圖 | IC Photo王興曾說，“太多人關注邊界，而不關注核心。”

5G我們超越了6G我們也將領先! 美國為什麼會害怕失去5G領導地位呢

而且在我們國內和美企中，有相當一部分覺得我們研發不了5G，更特說超越他們了。由於，我們在科技領域一直是，裝備一代，研發一代，探索一代。

界讀｜華為：幫助英國共渡疫情難關，無端批評令英國蒙受損失

前段時間，英國首相呼籲員工在家辦公的第二天，英國網絡就出現大面積崩潰現象，不僅無法正常上網，而且電話也不能打、短信也不能發，給用戶造成了很大的困擾。

為什麼華為今天可以傲視群雄，在世界上立於不敗之地？

為什麼華為今天可以傲視群雄，在世界上立於不敗之地？因為五年內沒有人能超過整個5G領域，所以美國人無法超越，為什麼？

血戰「在線辦公」，阿里、騰訊、字節、華為的底牌與大殺器

小海按：前端殺手級應用，後端雲服務，在線辦公「四小龍」之戰開啟。本來，在線辦公更多的是阿里巴巴的主場。

2020年最強拍照旗艦來了華為P40系列多項業界首創香！

原來華為P40Pro+在上一代P30 Pro潛望式鏡頭橫置長焦鏡頭模組和感光器件基礎之上，進一步採用全新的多反射潛望式光路摺疊技術，實現5次反射光路，光程比上一代潛望式長焦提升178%。

今天聊一聊直播

今天聊一聊直播突然談到這個話題，是因為後知後覺的我，突然發現幾乎所有大互聯網公司都進軍了網絡直播行業，或者正在準備進軍直播領域。

通過直播賺錢不容易，既要豁得出去，又要端得起來

今天咱們繼續聊一聊直播吧當下，像頭條、網易、百度等公司，看上去和直播八竿子打不著的公司，也開始涉足直播了。

AI和自動化技術聯手，最終會讓60%的工人失去現有的飯碗。

並非危言聳聽，AI和自動化結合，勢必會把數十億人類踢出勞動力市場，數量巨大的失業工人，將會構成一個規模龐大的新階級。AI最終會讓60%的工人失去現有的飯碗。

這個網還能不能好好上了？今日全球IPv4地址正式耗盡

長期以來，一直令人擔心的IPv4地址耗盡的問題，今天這一刻終於發生——所有43億個IPv4地址已分配完畢，這意味著沒有更多的IPv4地址可以分配給ISP和其他大型網絡基礎設施提供商。

12306系統不行？內行人告訴你它有多牛，阿里騰訊高手去了也膜拜

很多人認為12306系統很不好，之前我也是這麼認為的，因為我覺得像雙十一這麼大流量，阿里都能承受住，為什麼12306不行，這其實是誤解，12306擁有著神一般的架構設計，平時的壓力比淘寶大的多。

有內幕？美國防部授與微軟百億雲合同，亞馬遜不滿發起訴訟

據路透社消息，10月25日，美國防部將高達100億美元的十年期戰略合同授予微軟公司，這一舉動引起亞馬遜的不滿。

未來之芯--RISC-V總部從美國遷往瑞士，華為、阿里是其成員

北京時間26日消息，國際開源芯片技術組織RISC-V基金會週一宣佈，由於擔心美國的貿易限制，計劃將總部從美國特拉華州遷往瑞士。該基金會首席執行官卡利絲塔-雷蒙德（Calista Redmond）表示，希望確保美國以外的大學、政府和企業能夠幫助開發其開源技術。

神話還能繼續嗎？幾度過山車，比特幣半年來首次跌破7000美元

比特幣價格今年如同坐上過山車，年初的3000美元到最高13861.9美元，今天跌破7000美元，算是這半年來的最低點了。說起比特幣，給人印象最深刻的，莫過於2017年末到2018年初的暴漲了吧。

劉強東卸任後，突然宣佈一個“好消息”，讓馬雲措手不及！

蘋果的瘋狂其實從未停止，AirPower或將重新啟航

可是，蘋果事實上一直都在推動終端產品進入全面無線時代，所以他們是不太可能在真正意義上放棄這款產品。有外媒稱，蘋果目前正準備重新啟動AirPower項目。

曾保護近4億中國人的電腦，卻因得罪阿里、騰訊，慘遭市場淘汰

曾保護近4億中國人的電腦，卻因得罪阿里、騰訊，慘遭市場淘汰隨著網絡的不斷髮展，如何確保網絡信息安全成為人們十分重視的問題。

互聯網流量需求增大希臘民眾“宅生活”考驗網速

英國諮詢公司Tech4i2報告指出，在疫情期間，希臘的互聯網流量需求至少增長50%，但網速僅下降1.2%，而在大多數歐洲國家，網速平均下降了5%-7%。

互聯網科技企業，傳統辦公模式該走向何處?

　　紐約，處於美國疫情震中的城市，工作模式大多是使用公司發放的電腦進行遠程辦公，而在這之前，部分互聯網企業本來默認每週三為在家辦公日，所以大家對在線辦公可以說駕輕就熟。

微信又悄悄上線一新功能～網友卻開始擔心

備註後的群聊名稱僅自己可見往後再也不用為分清亂糟糟的微信群聊而困擾不過從目前來看只有iOS端上線了這一新功能安卓用戶還需要再等等並且此次更新為後臺更新無需到AppStore更新即可看到這個新功能該功能上線後網友們紛紛站隊但也有網友視野開闊擔心起另一件事對於微信新功能群備註你覺得實

正式確認！孫正義退出市值5959億阿里，20年與馬雲成就彼此

文：小娜說到孫正義這個名字，我們很多人都知道他是日本軟銀集團的創始人兼總裁，但他除此之外也有另外的身份，那就是阿里巴巴最大的董事之一。阿里之所以成為今天的阿里，與孫正義的投資是分不開的。當時，馬雲和孫正義僅僅交談了五分鐘，孫正義當即就決定投資阿里，而且一下就投資2000萬美元。

科技添柴“非接觸經濟”升溫

新華社記者王全超攝中國同拉美和加勒比國家舉行視頻工作會議，就新冠肺炎疫情防控開展交流。亞歷山大·培尼亞攝在中國科學技術大學附屬第一醫院，乘客用“無接觸電梯按鈕”操作電梯。

好像在哪見過？華為nova7官宣餘承東:何必只有一點點

全新iPhoneSE根據此前爆料，此次華為nova7系列將有nova7 SE、nova7和nova7 Pro三個版本，可能會採用“麒麟985+麒麟990”或“麒麟820+麒麟985+麒麟990”兩種芯片組合。

行業紅利、資本湧入，疫情後的在線教育聚師網如何“涅槃”

2018年，線下培訓機構受到了相關部門政策的影響，整體發展勢頭趨降，然而市場上對於教育的需求卻在不斷增加，於是，大量學員開始把需求放到了線上，其中，職業教育在這方面的變化尤其明顯。

數字貨幣真的來了？首吃螃蟹者傳出，碰一碰功能露臉

蘇州相城區政府相關人士對此未予置評，區金融局人士表示“不便答覆”，其他多個當地機關單位稱尚不知情，央行蘇州市中心支行表示“以總行口徑為準”，央行總行方面未予確認。新京報記者程維妙陳鵬編輯嶽彩周校對薛京寧

實例 | 200 SMART運動控制基本指令詳解

C_Dir:表示電機的當前方向信號狀態，0 = 正向 1 = 反向。 START:觸發開始發脈衝信號，必須要在運動軸空閒時發送一次信號，必須用邊沿觸發。