Anthropic 2024 年選舉與 AI 觀察報告

Anthropic 報告指出,在 Claude.ai 及其 API 的整體使用量中,與選舉相關的活動佔比不到 0.5%,在美國大選前的幾週內,這一比例僅增加到略高於 1%。這表明雖然生成式 AI 在重大選舉週期期間已變得普及,但其在選舉相關查詢中的實際使用量在模型總互動中仍佔極小比例。

選舉安全框架與執行

Anthropic 在整個 2024 年實施了三管齊下的安全方法,以減輕與選舉相關的風險:

  • 政策執行: 公司的 Usage Policy 禁止干預選舉、從事競選活動、推廣候選人或政黨、徵求捐款以及生成錯誤資訊。在 2024 年 5 月,這些政策得到了擴展,以專門應對選民針對性行為、冒充身分以及影響力活動。
  • 嚴格測試: Anthropic 與外部專家進行了十幾輪的政策漏洞測試(針對性紅隊測試)。這些測試專注於有害查詢的拒絕率、候選人之間的公平性,以及對不準確資訊的檢測。針對印度、南非、墨西哥、英國、法國和歐盟議會的選舉進行了定期測試,並在美國大選期間對錯誤資訊敘事進行了每日測試。
  • 權威性轉介: 尋求投票資訊的使用者被引導至非黨派來源,例如美國的 TurboVote/Democracy Works、英國的 Electoral Commission 以及法國的行政選舉網站。

在全球範圍內,Anthropic 採取了約 100 次與選舉相關的執行行動,包括對重複違規者的警告和帳號封禁。該公司指出,聊天機器人的放大風險低於社群媒體,因為 Claude 是透過一對一互動進行運作,且目前僅輸出文字,這消除了深偽技術(deepfakes)的威脅。

透過 Clio 工具進行使用分析

Anthropic 利用名為 Clio 的新型自動化工具來分析現實世界的語言模型使用情況。Clio 將原始對話提煉成抽象的主題集群,以提供關於模型如何被使用或被誤用的洞察。

對美國大選使用情況(11 月 2 日至 8 日)的分析顯示,約有三分之二的選舉相關對話涉及以下請求:

  • 分析並解釋政治制度、政策、時事和政治議題。
  • 分析政治數據,包括投票模式和政治趨勢。

其他使用案例包括翻譯選舉資訊以及生成有關政府和民主的教育性內容。

解決知識截止日期限制問題

Anthropic 識別出,為了防止在閃電選舉(snap elections)期間產生混淆的回答,對於模型知識截止日期進行透明溝通的關鍵需求。例如,當法國在 2024 年夏季舉行閃電選舉時,Claude(訓練截止至 2024 年 4 月)無法提供有關新選舉時間的準確資訊。

為了落實這一點,Anthropic 透過兩個主要管道實施了更清晰的溝通:

  1. 模型系統提示詞(Model System Prompts): 更新系統提示詞以明確說明截止日期。
  2. 使用者介面: 在 UI 中實施選舉橫幅,以鼓勵使用者尋找權威來源。

未來展望

Anthropic 主張,保護選舉完整性需要不斷的適應。該公司仍致力於加強產業協作、開發更先進的測試系統,並對其研究結果保持透明,以保護民主程序。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch