KPMG 因 LLM 幻覺撤回 AI 使用報告
KPMG 已撤回其專業服務報告《Redefining excellence in the age of agentic AI》,因為發現該文件包含 AI 生成的幻覺。此事件凸顯了在使用生成式 AI 輔助製作高價值專業服務報告時,品質保證流程的嚴重失效。
Agentic AI 報告的撤回
在發現幻覺(即 AI 模型生成看似合理但事實錯誤的資訊)後,KPMG 撤回了題為《Redefining excellence in the age of agentic AI》的報告。這次撤回為使用 Large Language Models (LLMs) 來製作市場研究和戰略諮詢報告的公司敲響了警鐘。
諮詢業中 AI 幻覺的產業性模式
這次失敗並非專業服務領域中的孤立事件。社群討論顯示,其他大型諮詢公司也面臨過類似問題。例如,使用者指出先前發生過涉及 Deloitte 在澳洲的事件,當時在政府相關的工作中出現了 AI 生成的不準確資訊。
AI 生成內容的技術緩解策略
為了防止技術或財務報告中的幻覺,實施自動化驗證層是至關重要的。一種常見的技術方法是使用「sub-agent」架構,即指派一個獨立的 AI agent 專門負責根據原始資料驗證所有引用、數據和引文。
正如社群中的技術貢獻者所指出的:
The crazy thing is the level of effort to say, "have a sub agent validate all references and figures" is so low. It would have prevented 99% of the face palms.
這種交叉檢查機制降低了模型使用過時數據或捏造引文的風險,這對於高價位銷售的報告而言是至關重要的要求。
AI 炒作週期的分析
KPMG 報告的撤回凸顯了一個系統性問題,即生成式 AI 的炒作週期正在加速。一些觀察家認為,技術本身正在撰寫自己的炒作內容,形成了一個回饋迴圈,即 AI 生成的內容被用來推廣同一技術的能力,而這往往是以犧牲事實準確性為代價。