前沿模型論壇公告

OpenAI、Google、Microsoft 和 Anthropic 已成立 Frontier Model Forum,以制定全產業範圍的安全標準與評估,確保前沿 AI 模型的負責任開發與部署。此舉旨在透過提供跨組織合作的平台,彌合政府努力與產業實踐之間的差距,以促進 AI 安全。

Frontier Model Forum 的主要目標

Frontier Model Forum 將在未來一年內聚焦於三個主要行動領域,以減輕先進 AI 系統相關的風險:

1. 識別最佳實踐

論壇將促進產業領袖、政府、民間社會與學術界之間的知識與最佳實踐分享。主要目標是建立安全標準與實踐,以減輕與前沿 AI 模型相關的廣泛潛在風險。

2. 推進 AI 安全研究

論壇計畫透過識別並協調最關鍵的開放性問題研究來支援 AI 安全生態系統。技術重點領域包括:

  • Adversarial robustness: 確保模型對惡意輸入具有韌性。
  • Mechanistic interpretability: 理解模型的內部運作。
  • Scalable oversight: 管理日益複雜系統的安全。
  • Independent research access: 提供外部驗證的途徑。
  • Emergent behaviors and anomaly detection: 識別模型的意外能力。

最初,論壇將優先開發並分享一個公開的技術評估與基準庫,用於前沿 AI 模型。

3. 促進資訊分享

論壇將建立安全且可信的機制,在公司、政府與利益相關者之間分享有關 AI 安全與風險的資訊。此流程將遵循負責任揭露的既定最佳實踐,參考網路安全產業現有的框架。

AI 治理的產業觀點

領先的 AI 實驗室強調了集體行動的必要性,以確保 AI 始終受人類控制並惠及社會:

"開發 AI 技術的公司有責任確保其安全、可靠,並始終受人類控制。此舉是讓科技產業攜手推進負責任 AI 發展的重要一步..." — Brad Smith, 副董事長兼總裁, Microsoft

"AI 公司——尤其是那些正在開發最強大模型的公司——必須在共同基礎上達成一致,並推進深思熟慮且具彈性的安全實踐..." — Anna Makanju, 全球事務副總裁, OpenAI

"Anthropic 相信 AI 有潛力從根本上改變世界的運作方式。我們很興奮能與產業、民間社會、政府與學術界合作,推動該技術的安全與負責任發展。" — Dario Amodei, 首席執行官, Anthropic

"我們很興奮與其他領先的公司合作,分享技術專長以推進負責任的 AI 創新。" — Kent Walker, 全球事務總裁, Google & Alphabet

Sources