互联网集体记忆的侵蚀
数字检索的危机
互联网上的信息检索正在从确定性的指针系统转向概率性的猜测系统。这种转变正在损害基本事实的准确性,并使原始来源变得越来越难以发现。
Google 的 AI 生成摘要(AI Overviews)在常见搜索中引入了显著的事实错误。例如,用户报告称 AI 虚构了日落时间,导致错过了活动。这种转变代表了从“中立网关”模型(搜索引擎将用户引导至来源)向编辑模型(搜索引擎用自己的语言重写信息)的转变。这种变化已经导致了法律后果;德国法院最近裁定 Google 对其 AI overview 功能生成的错误陈述负责,因为该功能错误地将出版公司与欺诈性商业行为联系起来。
数字语料库的崩溃
由于企业利益、技术衰退和 AI 驱动的流量转移,存储互联网集体记忆的基础设施正在崩溃。
企业抹除与链接失效
数字内容正在以加速的速度被删除。一个显著的例子是 Walt Disney Company 在 FiveThirtyEight 停止作为活跃的收入生成资产后,决定删除其几乎整个存档。这表明了一种趋势,即数字档案被视为负债或成本中心,而非文化记录。
Wikipedia 的悖论
Wikipedia,全球最重要的公共知识资源之一,正面临系统性威胁。AI 系统现在抓取并摄取 Wikipedia 的内容以提供直接答案,从而消除了用户点击进入原始页面的需求。这创造了一个负反馈循环:不断减少的流量减少了维持百科全书运营所需的关注度和捐款。
Internet Archive 的法律斗争
Internet Archive 及其 Wayback Machine——互联网最接近失效保护的备份——正承受着巨大的压力。除了对互联网进行索引的工程压力外,该组织还因其数字借阅计划面临着昂贵的诉讼。此外,新闻机构正越来越多地阻止 Wayback Machine 的爬虫,以防止 AI 公司将存档页面作为版权材料的间接来源。
社区观点的综合
围绕这种侵蚀的技术讨论突出了几个关键的紧张关系:
- “AI Ouroboros” 效应: 用户和开发者警告称,存在一种负反馈循环,即 AI 是在 AI 生成的“slop”(低质量内容)上进行训练的,这会导致模型质量随时间推移而退化。一位用户指出,AI 现在可以引用另一个 AI 的幻觉作为事实。
- 文档的消亡: 开发者报告称,通过传统搜索越来越难找到技术参考文档,迫使人们依赖可能产生 API 细节幻觉的 AI。
- 广告模式的失败: 批评者认为,Google 的优先级已从用户转向了广告商,导致了“优先级倒置”,即搜索质量为了变现和 AI 驱动的参与度而被牺牲。
- 回归策展: 面对公共网络上的“slop 粪池”,出现了一种向个人网站、策展型通讯(newsletters)和私人档案的回归运动。
“我们正在建造世界上最大的图书馆,然后锁上门,在灯光熄灭之前让机器人复印一切。”
迈向数字主权
为了防止集体记忆的完全丧失,人们正在推动将信息检索视为一种战略性公共资产,而非消费者服务。
国家级替代方案
一些政府已经在实施对 Big Tech 平台的替代方案。法国采用了 Qwant,一个托管在欧洲的保护隐私的搜索引擎,以及 Tchap,一个本土开发的即时通讯应用,以减少对 Silicon Valley 的依赖。同样,,European Commission 已加入 W Social,一个独立的社交网站。
公共利益架构
有一种日益增长的论点,即应该创建公共利益数字基础设施,类似于政府管理道路或国家安全的方式。这包括支持像 Library and Archives Canada 和 Internet Archive Canada 这样的机构,以确保历史记忆得以保存,不是因为其有利可图,%,而是因为它是公共利益。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch