← 返回 Siami 首頁

Google 搜尋正在死去,下一個更糟:當 AI 吞噬網路,集體記憶也跟著消失

▲ 299 💬 291
Google 搜尋正在死去,下一個更糟:當 AI 吞噬網路,集體記憶也跟著消失

編按:本文綜合整理自 The Walrus、Vass Bednar 原稿、404 Media 與 Decrypt 報導,並加入 Siami 編輯部觀點與分析。

很多人會在 Google 搜「今天日落時間」。這個日常小問題突然變得棘手——近日有使用者發現,Google 的 AI 摘要開始亂給時間。科羅拉多斯普林斯一位 Facebook 網友寫道:「我把投影機搬到戶外等日落,結果 AI 跟我說太陽已經下山了,但其實我活得好好的,還在當下。」這是個小錯誤、帶點喜感,但反映出更深層的問題:全球最大的搜尋引擎,連基本事實都會搞錯。曾經因為「給出對的答案」而建立聲譽的公司,現在被業界觀察者形容為「失去了鋒利度」。

從「搜尋變笨」到「基礎建設崩塌」

當搜尋結果變差,我們抱怨 Google「爛掉了」(enshittified);當 AI 亂編內容,我們說模型「不嚴謹」;當假訊息擴散,我們安慰自己「真相還在那裡」,只是需要下更好的關鍵字。即使網路充斥 AI 內容農場(slop),我們仍堅信這是「搜尋技巧」的問題,繼續分享各種 Google 密技。

但換個角度想:如果「真相」越來越難在網路上找到,是因為過去承載它的基礎建設正在解體呢?

「真相」從來不是從搜尋引擎吐出來的。搜尋引擎只是入口;當入口後面那些原始檔案、志願者維護的百科、被歸檔的網頁快照一一消失,連最聰明的 AI 也只能對空氣做摘要。

連結腐蝕(link rot)每天都在吞噬網頁。美國國會圖書館的網站曾因為程式錯誤,短暫讓憲法部分內容從站上消失。Google 把一個會出錯的 AI 擋在使用者與原始資料之間,等於確保即使底層頁面還存在,使用者實際上也找不到它。

更糟的是,污染已經蔓延到上游。404 Media 報導,企業開始在 Reddit 系統性植入內容,藉此影響 AI 搜尋的答案輸出——等於從源頭毒化那些 AI 系統賴以生成摘要的公共資料庫。整個語料庫正在即時崩塌。

從被禁書到被靜音網頁:數位刪除沒有人會發現

這個劣化的數位空間,逼我們重新思考「文化主權」的定義。目前的辯論多半圍繞著「外國大型平台(Netflix、YouTube、Spotify)是否該支持加拿大內容」這類命題,但更深層的問題被繞過了:誰來保存、並控制我們文化紀錄的近用權——不只是當下,而是未來好幾個世代?

搜尋不能再假裝自己是通往穩定知識體系的中性入口。網路一直以來都是圍繞中介者組織起來的,這些中介者決定哪些內容會留下、誰會看到它們;但現在網路的檔案保存功能,正承受來自利益截然相反、且經常衝突的各方壓力。

書被禁,至少是明著來的:有反派、有校董會、有聳動的新聞標題。數位刪除更陰險——一本被禁的書仍找得到;一個被清除的網頁,會消失得如此徹底,幾乎沒人會意識到它曾經存在。

FiveThirtyEight 是美國知名的民調分析與政經部落格,曾被華特迪士尼公司透過子公司持有超過十年。創辦人 Nate Silver 在 2023 年離開,剩餘編輯在 2025 年 3 月被裁員。一旦迪士尼判定這個站「不再是活躍資產——沒有新內容、沒有廣告收益」,他們就直接把整個歷史檔案刪掉。


連 Wikipedia 都變成自己消失的基礎建設

檢索危機已經蔓延到 Wikipedia——這個全世界最重要的志工營運公共知識庫之一。多年來,搜尋引擎為它帶進數十億次瀏覽。但現在,AI 系統直接爬取並消化 Wikipedia 內容來生成結果,使用者不再需要點進原始頁面。Wikipedia 變成「自己消失的基礎建設」:流量萎縮意味著關注與捐款不再穩定回流,這本百科全書的維生系統正在被掏空。

更令人不安的是 Internet Archive 的處境。這個非營利數位圖書館蒐集並提供那些可能會消失的素材——從錄音、歷史文件到書籍。它最知名的服務是 Wayback Machine,這個工具已經在不同時間點為網路截取了數千億張快照。記者、研究者、歷史學家、律師與一般民眾都仰賴它來恢復被刪的頁面、查證過去的聲明、記錄網路內容的變動。Wayback Machine 是網路最接近「故障安全備份記憶體」的東西。

但這個專案不只要扛著索引與儲存爆炸性成長資料庫的工程壓力,還要承受網路攻擊與昂貴訴訟。在出版商就 IA 的數位借閱計畫(digital lending)贏得訴訟、將其認定為未經授權的複製後,新聞機構開始因為擔心歸檔頁面會被 AI 公司當作間接的版權內容來源,轉而封鎖 Wayback Machine 的爬蟲。每一道新的限制,都讓這個檔案庫無法再作為完整的後盾。

連 Instagram 限時動態、WhatsApp 狀態更新這類稍縱即逝的格式普及,也代表著文化、社會與政治溝通的大塊內容,從一開始就從未被保存。


法國與歐洲的數位主權實驗

社會或許能撐過糟糕的搜尋結果、想辦法另闢蹊徑安排一場浪漫的日落之約。但如果我們連集體記憶都留不住、找不回來,就別談什麼主權。

法國早把外國平台視為對科技主權與國家網路安全的威脅。早在 2018 年底,法國國會與國防部就開始採用 Qwant——一個託管在歐洲的法國服務。Qwant 採取不同模式:不儲存搜尋資料、不販售個資、不基於瀏覽紀錄投放目標式廣告。歐洲議會連同其 720 位民選議員與數千名行政人員也跟進轉換,反映「資訊檢索本身就是一項戰略資產」的認知正在抬頭。

每一樁對 Big Tech 的小分手,都把「可能性」這扇門撐得更開。法國現在要求公務人員使用 Tchap——一個取代 WhatsApp 與 Signal 的國產通訊軟體。歐洲多國政府也跟進減少對矽谷的依賴,把數十萬個工作站的微軟產品換成開源替代方案。歐盟執委會也剛宣布加入 W Social——一個由瑞典新創建立的獨立社群平台。丹麥數位化部長 Caroline Stage Olsen 的話點出核心:「太多公共數位基礎建設現在綁在少數外國供應商手上,這讓我們變得脆弱。」

德國法院近期做出可能成為標竿的判決:認定 Google 須為 AI 摘要功能產生的不實陳述負責。這起案件的起因是 Google AI 錯誤地將兩家出版公司與詐騙商業行為做連結。法院的邏輯是:搜尋引擎用自己的話改寫、摘錄資料,它所做的就不只是公正地把使用者導向公共紀錄,而是在「撰寫全新一層的內容」——而這就帶來編輯責任。


公共網際網路不能再靠志工撐下去

Wikipedia 神奇,Wayback Machine 不可或缺。但我們必須停止假裝「志願精神」能獨力撐起公共網際網路。我們在其他領域早就理解這個道理:道路不是由叫車平台管,支付 app 不制定貨幣政策,雲端服務商不會決定國家安全框架(至少目前還不會)。但我們對治理數位依賴的態度,卻驚人地輕率。

加拿大有現成的公共利益基礎建設可以用:Library and Archives Canada 負責保存聯邦網路紀錄與歷史資訊;Internet Archive Canada 與總部合作,在加拿大大學託管資料備份。加拿大也蓋過這類數位基礎建設——CANARIE 為大學、研究者、創新者建立全國研究與教育網路;1990 年代的 SchoolNet 與 Community Access Program 讓學校與圖書館在網路普及之前就上線;Simon Fraser 大學的 Public Knowledge Project 從 2002 年開始打造 Open Journal Systems,幫助數千本學術期刊脫離商業平台的箝制;MapleMusic 在串流吞噬音樂探索之前,曾為加拿大音樂建立線上市集。

這些專案共享一個我們應該找回的前提:加拿大不必等私人平台來組織與掌控我們的數位生活。

舊的交易正在日落:把好奇心交給 Google,世界交給你。浮上來的可能是一個更怪異、更合成的網路——由機器隨機記得、由中介者從中獲利。或者,也可能是一個更堅固的公共網路:歷史記憶被保存下來,不是因為有利可圖,而是因為它屬於我們。

公共知識的未來,不只取決於「什麼會留下」,更取決於「誰有決心與動機去保存」。

連這篇文章也不會永遠在網上。它應該永遠在嗎?


為什麼這件事重要

Vass Bednar 這篇文章真正點出的,不是「Google 變難用」這種技術抱怨,而是一場靜悄悄的公共基礎建設危機。當搜尋引擎從「通往原始資料的入口」變成「用 AI 摘要取代原始資料的替代品」,整個網路作為人類集體記憶庫的角色就開始剝落。

這對中文讀者尤其切身。台灣與華語圈的內容農場污染、百度與抖音搜尋結果的商業化偏移、可用的替代搜尋引擎寥寥可數——我們其實正處在同一條「集體記憶被 AI 摘要中介」的下坡路上,只是以不同形式呈現。當 Google 在歐美被反壟斷、被監管、被迫交出選擇權,在華語世界我們甚至沒有同等量級的替代方案可以退守。

更關鍵的是,這不只是搜尋引擎的問題,而是支撐開放網路的所有非營利基礎建設的問題。Wikipedia 的捐贈模式、Internet Archive 的訴訟壓力、開源瀏覽器與搜尋引擎的市占率——全都站在同一個懸崖邊。當這些基礎建設開始掏空,AI 摘要再聰明也只能從越來越稀薄的語料中提煉「集體記憶」,品質只會越來越糟。

我們正處於一個關鍵的轉折點:下一個十年,公眾要嘛學會把「搜尋」當成需要付費、需要公民監督、需要制度保護的基礎建設(就像自來水、電力、道路),要嘛接受一個由 AI 摘要驅動、由廣告與中介者決定我們能記得什麼的網路。


數據解讀與質疑

幾個值得追蹤的硬數字:

  • Wikipedia 人類頁面瀏覽量年減 8%(2025 vs 2024 同月份),由 Wikimedia Foundation 的 Marshall Miller 公開承認,主因是 AI 摘要與社群影片取代了直接造訪
  • Cornell 大學研究:在 Reddit、Wikipedia、Quora、Facebook 等使用者生成內容網站上,僅 13 個單字的擷取片段,就能讓 AI 搜尋代理穩定輸出垃圾或詐騙內容
  • Google 搜尋引發的媒體流量雪崩:2026 年 6 月止的 12 個月內,USA Today 自 Google 的流量暴跌近 50%、Business Insider 暴跌 85%、Politico 下降 23%(數據來源:Semrush)
  • Internet Archive 兩場官司:Hachette book scanning 案、Great 78 Project 案合計面臨約 7 億美元求償,雖然都以和解收場,但 IA 不能再以同樣方式運作主要計畫
  • Google AI Overviews 引用的 Reddit 內容曝光率 2025 年成長 450%——這同時說明了 Reddit 對 AI 答案的影響力,也解釋了為什麼企業開始把 Reddit 當作新的 SEO 戰場

Siami 編輯部必須提出的質疑:所謂「AI 摘要讓搜尋更便利」這個論述,是建立在它持續從開放、可信任的網路源源不絕吸取資料的前提上。一旦上游污染(Reddit 投毒)、中游失血(Wikipedia 流量萎縮)、下游崩塌(Internet Archive 被訴訟壓垮)三條戰線同時發生,AI 摘要這座空中樓閣就會從根爛起。這不是技術問題,是治理與制度問題——而我們還沒有任何國家或國際組織,正視這件事的急迫性。


參考資料

404 Media 影片:企業如何用 Reddit 污染 AI 搜尋

網友熱門留言 (5)

#1 Hacker News 讀者 ▲ 412
這篇很關鍵的一點:問題不只是『Google 變笨了』,而是『產生答案的基礎建設正在崩塌』。Link rot、AI 摘要錯誤、企業污染 Reddit 這三件事,正在從不同面向腐蝕我們對『網路記得住事情』的信任。
#2 Reddit r/technology ▲ 287
我已經從 Google 換到 Kagi 一年了,回不去了。付費換來的是沒有 AI 亂編、沒有 SEO 農場、沒有「看起來像答案但其實是廣告」的結果。隱私也終於是預設值。
#3 數位保存研究者 ▲ 156
Wikipedia 流量年減 8% 不是單一事件,這是『使用者免費、平台收費』這個 20 年默契的第一個裂縫。當中間人不再把讀者送回源頭,整個公共知識基礎建設的捐贈模式就會跟著崩塌。
#4 CNET 編輯 ▲ 134
2026 年 7 月 USA Today 自 Google 流量 12 個月暴跌 50%、Business Insider 暴跌 85%。壓力已經大到讓媒體開始認真考慮全面封鎖 Google 爬蟲。
#5 圖書館從業者 ▲ 98
Internet Archive 在 Hachette 案之後又面臨 Great 78 Project 7 億美元求償。這個非營利組織如果倒下去,我們就失去網路唯一的 failover 記憶體。