網路集體記憶的侵蝕

數位檢索的危機

網路上的資訊檢索正從確定的指標系統轉向機率性的猜測系統。這種轉變正在損害基本事實的準確性,並使原始來源變得越來越難以發現。

Google 的 AI 生成摘要(AI Overviews)已在常見搜尋中引入了顯著的事實錯誤。例如,使用者回報 AI 虛構了日落時間,導致錯過了活動。這種轉變代表了從「中立閘道」模式(搜尋引擎將使用者引導至來源)向編輯模式的轉變,即引擎用自己的語言重寫資訊。這種變化已經導致了法律後果;德國法院最近判定 Google 需為其 AI overview 功能產生的錯誤陳述負責,因為該功能錯誤地將出版公司與詐欺性商業行為聯繫起來。

數位語料庫的崩潰

由於企業利益、技術衰退和 AI 驅動的流量轉移,儲存網路集體記憶的基礎設施正在崩潰。

企業抹除與連結失效

數位內容正以加速的速度被刪除。一個顯著的例子是 Walt Disney Company 在 FiveThirtyEight 停止作為活躍的營收產生資產後,決定刪除其幾乎整個檔案庫。這顯示了一種趨勢,即數位檔案被視為負債或成本中心,而非文化紀錄。

Wikipedia 的悖論

Wikipedia 是世界上最重要的公共知識資源之一,正面临著系統性威脅。AI 系統現在會抓取並吸收 Wikipedia 的內容來提供直接答案,從而消除了使用者點擊進入原始頁面的需求。這造成了一個負面回饋圈:日益減少的流量減少了維持百科全書運作所需的關注度和捐款。

Internet Archive 的法律戰

Internet Archive 及其 Wayback Machine——網路最接近失效保護的備份——正承受著巨大的壓力。除了索引網路的工程壓力外,該組織還面臨著關於其數位借閱計畫的昂貴訴訟。此外,新聞機構正日益增加地封鎖 Wayback Machine 的爬蟲,以防止 AI 公司將存檔頁面作為版權材料的間接來源。

社群觀點的綜合

圍繞這場侵蝕的技術討論突顯了幾個關鍵的緊張關係:

  • 「AI Ouroboros」效應: 使用者和開發者警告,AI 是在 AI 生成的「slop」上進行訓練的,這會導致模型品質隨著時間推移而退化。一位使用者指出,AI 現在可以將另一個 AI 的幻覺引用為事實。

  • 「文件紀錄的死亡」: 開發者回報,透過傳統搜尋,技術參考文件變得越來越難以尋找,迫使人們依賴可能在 API 細節上產生幻覺的 AI。

  • 廣告模式的失敗: 批評者認為,Google 的優先事項已從使用者轉向廣告商,導致了「優先權倒置」,即搜尋品質被犧牲以換取變現與 AI 驅動的參與度。

  • 回歸策展: 對於公共網路上的「slop 糞池」,作為一種反應,個人網站、策展式電子報和私人檔案庫的運動正在興起。

"We're building the world's largest library and then locking the doors, letting the bots photocopy everything before the lights go out。"

邁向數位主權

為了防止集體記憶的完全喪失,目前有一股力量在推動將資訊檢索視為戰略性公共資產,而非消費者服務。

國家替代方案

一些政府已經在實施替代於 Big Tech 平台的方案。法國採用了 Qwant,一個在歐洲託管的隱私保護搜尋引擎,以及 Tchap,一個本土的通訊應用程式,以減少對 Silicon Valley 的依賴。同樣地,歐洲委員會也加入了 W Social,一個獨立的社群網站。

公共利益架構

有一種日益增長的論點,主張建立公共利益的數位基礎設施,類似於政府管理道路或國家安全的方式。這包括支持像 Library and Archives Canada 和 Internet Archive Canada 這樣的機構,以確保歷史記憶得以保存,不是因為它有利可圖,並而是因為它是公共利益。

Sources

相關