“氛围引用”的兴起:AI 幻觉如何毒害了一份四大报告

专业服务行业目前正面临着关于生成式 AI 集成的反思。虽然效率的承诺极具吸引力,但 GPTZero 最近的一项调查揭露了全球最负盛名的咨询公司之一在质量控制方面的严重失败。

一份题为 Points of Attack: Uncovering Cyber Threats and Fraud in Loyalty Systems 的 EY Canada 报告已成为 GPTZero 所称的“氛围引用”(vibe citing)的一个案例研究——即允许 LLM 生成看起来正确但毫无事实依据的虚假引用。这种现象不仅仅是一个技术故障;它是一种专业审核的系统性失败,威胁着要毒害全球数字知识库。

幻觉报告的解剖

根据 GPTZero 的调查,这份 44 页的报告是“氛围引用、错误归属、虚假统计数据和 AI 编写文本的拼凑物”。这些失败并非细微之处;它们从失效的 URL 到完全捏造的来源,范围广泛。

捏造的来源与信息“洗白”

最令人担忧的发现之一是“信息洗白”的过程。该报告引用了 McKinsey & Company 2022 年关于未兑换忠诚度积分价值的一份报告。然而,那份 McKinsey 报告并不存在。

调查显示,EY 可能从 Financial IT 的一篇不起眼的 fintech 博客文章中提取了这一引用。该博客文章本身就幻觉出了 McKinsey 的引用。通过引用该博客,EY 有效地将一个来自低质量来源的幻觉“洗白”到了“四大”出版物中,赋予了其不应有的权威感。

内部矛盾与“AI 废料”

除了虚假引用,报告中还充斥着内部矛盾——这是“AI slop”的标志性特征。例如:

  • 2000 亿美元的差异: 在执行摘要中,报告声称全球忠诚度积分市场为 2000 亿美元。随后,在第 10 页,它声称这 2000 亿美元仅是未兑换积分的价值。如果 30-50% 的积分未被使用(如报告所称),那么总市场规模必须达到 4000 亿美元或更多。
  • 归属错误统计数据: 一项关于 72% 的忠诚度计划报告欺诈的说法在第 6 页被归于 Paystone,但在第 11 页却被归于 Forter。实际上,原始来源似乎是 2017 年的 Ipsos 调查。

系统性风险:毒害水源

“氛围引用”的危险不仅限于一份错误的报告。当一家拥有 EY 品牌资产的公司发布捏造的数据时,它会创造一个错误信息的反馈循环。

首先,该报告会被声誉良好的新闻机构(如 Canberra Times)引用,从而进一步使虚假数据合法化。其次,这些报告会被 AI “深度研究”工具摄取。由于这些工具依赖的信号与人类不同,它们更容易受到这种数据毒害的影响。一旦幻觉被高权威域名的网站发布,它就会成为未来 AI 智能体和人类研究人员眼中的“真理”。

人为因素:为什么会发生这种情况

Hacker News 上的社区讨论突显了企业环境中的深层文化问题。问题不在于缺乏 AI,而在于缺乏人类审核。

“我们在许多职业中看到的现象是,AI 输出的内容没有得到专业人士的审核……充其量他们只是扫一眼,最坏的情况是,在发布之前他们甚至根本没看到过。”

几位贡献者指出了“garbagemaxxing”的趋势——即高层管理人员推动发布不含任何实际操作信息的 AI 生成的“废料”,这通常是企业裁员背景下试图“以少办更多”的结果。其结果是一个危险的缺口:审核内容所需的专业知识要么被压倒,要么处于缺失状态,导致“专业权威的氛围”取代了实际的严谨性。

结论

EY Canada 的事件是一个警告:来源的声誉不再是其内容准确性的保证。在生成式 AI 时代,验证引用是否准确的摩擦力是质量的主要障碍。当这种摩擦力通过自动化被移除,而没有相应的增加人类监督时,结果不是效率——而是公众信任的侵蚀和全球知识库的退化。

Sources