「氛圍引用」的興起:AI 幻覺如何毒害四大會計師事務所的報告
專業服務業目前正因生成式 AI 的整合而面臨一場清算。雖然效率提升的前景極具吸引力,但 GPTZero 最近的一項調查揭露了全球最負盛名的諮詢公司之一在品質控制方面的嚴重失敗。
一份由 EY Canada 發布、題為 Points of Attack: Uncovering Cyber Threats and Fraud in Loyalty Systems 的報告,已成為 GPTZero 所稱「氛圍引用」(vibe citing)的案例研究——這種做法是允許 LLMs 生成看似正確但毫無事實根據的虛假引用。這種現象不僅僅是技術故障;它是專業審核制度的系統性失敗,威脅著要毒害全球數位知識庫。
幻覺報告的解剖
根據 GPTZero 的調查,這份 44 頁的報告是「氛圍引用、錯誤歸屬、虛假統計數據和 AI 撰寫文本的拼貼畫」。這些錯誤並非細微;它們從失效的 URL 到完全捏造的來源都有。
捏造的來源與資訊「洗錢」
最令人擔憂的發現之一是「資訊洗錢」的過程。該報告引用了 McKinsey & Company 在 2022 年關於未兌換忠誠度積分價值的一份報告。然而,那份 McKinsey 報告根本不存在。
調查顯示,EY 可能從 Financial IT 一篇不起眼的金融科技部落格文章中提取了此引用。該部落格文章本身就已經幻覺出了 McKinsey 的引用。透過引用該部落格,EY 有效地將一個來自低品質來源的幻覺「洗錢」進了一份「四大」出版物中,賦予其不應有的權威感。
內部矛盾與「AI 廢料」
除了虛假引用外,該報告還充斥著內部矛盾——這是「AI slop」的典型特徵。例如:
- 2000 億美元的差異: 在執行摘要中,報告聲稱全球忠誠度積分市場為 2000 億美元。隨後在第 10 頁,它聲稱這 2000 億美元僅僅是未兌換積分的價值。如果 30-50% 的積分未被使用(如報告所述),則總市場規模必須達到 4000 億美元或更多。
- 錯誤歸屬的統計數據: 一項聲稱 72% 的忠誠度計畫報告存在欺詐的說法,在第 6 頁被歸於 Paystone,但在第 11 頁卻被歸於 Forter。實際上,原始來源似乎是 2017 年的 Ipsos 調查。
系統性風險:毒害源頭
「氛圍引用」的危險不僅限於單份錯誤的報告。當一家擁有 EY 品牌價值的公司發布捏造的數據時,它會創造一個錯誤資訊的迴圈。
首先,該報告會被聲譽良好的新聞媒體(如 Canberra Times)引用,進一步使虛假數據合法化。其次,這些報告會被 AI 「深度研究」工具攝取。由於這些工具依賴與人類不同的訊號,它們更容易受到這種數據毒害的影響。一旦幻覺被高權威網域發布,它就會成為未來 AI 代理和人類研究人員眼中的「真理」。
人為因素:為什麼會發生這種事
Hacker News 上的社群討論突顯了企業環境中更深層次的文化問題。問題不在於缺乏 AI,而在於缺乏人類審核。
"The problem we're seeing across many professions is AI output is not getting vetted by knowledgeable people... At best they skim, at worst they don't even see it at all before it's published."
幾位貢獻者指出了一種「garbagemaxxing」的趨勢——即高層管理人員推動發布 AI 生成的廢料,其中包含零具備行動力的資訊,這通常是是在企業裁員潮中試圖「以少做多」的結果。其結果是一個危險的缺口,即審核內容所需的專業知識被壓倒或缺席,導致「氛圍」式的專業權威感取代了實際的嚴謹性。
結論
EY Canada 的事件是一個警告:來源的聲望不再是 gewährleisten 內容的準確性。在生成式 AI 時代,驗證引用的摩擦力是品質的關鍵屏障。當這種摩擦力被自動化移除,卻沒有相應增加人類監督時,結果並非效率提升——而是公眾信任的侵蝕與全球知識庫的退化。