前沿模型論壇公告
OpenAI、Google、Microsoft 和 Anthropic 已成立 Frontier Model Forum,以制定全產業範圍的安全標準與評估,確保前沿 AI 模型的負責任開發與部署。此舉旨在透過提供跨組織合作的平台,彌合政府努力與產業實踐之間的差距,以促進 AI 安全。
Frontier Model Forum 的主要目標
Frontier Model Forum 將在未來一年內聚焦於三個主要行動領域,以減輕先進 AI 系統相關的風險:
1. 識別最佳實踐
論壇將促進產業領袖、政府、民間社會與學術界之間的知識與最佳實踐分享。主要目標是建立安全標準與實踐,以減輕與前沿 AI 模型相關的廣泛潛在風險。
2. 推進 AI 安全研究
論壇計畫透過識別並協調最關鍵的開放性問題研究來支援 AI 安全生態系統。技術重點領域包括:
- Adversarial robustness: 確保模型對惡意輸入具有韌性。
- Mechanistic interpretability: 理解模型的內部運作。
- Scalable oversight: 管理日益複雜系統的安全。
- Independent research access: 提供外部驗證的途徑。
- Emergent behaviors and anomaly detection: 識別模型的意外能力。
最初,論壇將優先開發並分享一個公開的技術評估與基準庫,用於前沿 AI 模型。
3. 促進資訊分享
論壇將建立安全且可信的機制,在公司、政府與利益相關者之間分享有關 AI 安全與風險的資訊。此流程將遵循負責任揭露的既定最佳實踐,參考網路安全產業現有的框架。
AI 治理的產業觀點
領先的 AI 實驗室強調了集體行動的必要性,以確保 AI 始終受人類控制並惠及社會:
"開發 AI 技術的公司有責任確保其安全、可靠,並始終受人類控制。此舉是讓科技產業攜手推進負責任 AI 發展的重要一步..." — Brad Smith, 副董事長兼總裁, Microsoft
"AI 公司——尤其是那些正在開發最強大模型的公司——必須在共同基礎上達成一致,並推進深思熟慮且具彈性的安全實踐..." — Anna Makanju, 全球事務副總裁, OpenAI
"Anthropic 相信 AI 有潛力從根本上改變世界的運作方式。我們很興奮能與產業、民間社會、政府與學術界合作,推動該技術的安全與負責任發展。" — Dario Amodei, 首席執行官, Anthropic
"我們很興奮與其他領先的公司合作,分享技術專長以推進負責任的 AI 創新。" — Kent Walker, 全球事務總裁, Google & Alphabet
Sources
- OriginalFrontier Model Forum