前沿模型论坛公告

OpenAI、Google、Microsoft 和 Anthropic 已成立前沿模型论坛,以制定行业范围的安全标准和评估,确保前沿 AI 模型的负责任开发和部署。此举旨在通过提供跨组织协作的平台,弥合政府努力与行业实践之间的差距,以推进 AI 安全。

前沿模型论坛的主要目标

前沿模型论坛将在未来一年聚焦于三个主要行动领域,以减轻先进 AI 系统相关的风险:

1. 识别最佳实践

论坛将促进行业领袖、政府、民间社会和学术界之间的知识和最佳实践共享。主要目标是建立安全标准和实践,以减轻前沿 AI 模型可能带来的广泛风险。

2. 推进 AI 安全研究

论坛旨在通过识别和协调最关键的开放性问题的研究来支持 AI 安全生态系统。技术重点领域包括:

  • 对抗鲁棒性: 确保模型对恶意输入具有韧性。
  • 机制可解释性: 理解模型的内部工作原理。
  • 可扩展监督: 管理日益复杂系统的安全。
  • 独立研究访问: 为外部验证提供途径。
  • 新兴行为和异常检测: 识别模型的意外能力。

最初,论坛将优先开发和共享前沿 AI 模型的技术评估和基准的公共库。

3. 促进信息共享

论坛将建立安全可信的机制,在公司、政府和利益相关者之间共享有关 AI 安全和风险的信息。此过程将遵循负责任披露的既定最佳实践,借鉴网络安全行业使用的现有框架。

AI 治理的行业视角

领先的 AI 实验室强调了集体行动的必要性,以确保 AI 始终在人类控制之下并惠及社会:

"创建 AI 技术的公司有责任确保其安全、可靠并始终在人类控制之下。此举是将科技行业凝聚在一起,负责任地推进 AI 的重要一步..." — Brad Smith, Vice Chair & President, Microsoft

"AI 公司——尤其是那些正在开发最强大模型的公司——必须在共同基础上保持一致,并推进深思熟虑且可适应的安全实践..." — Anna Makanju, Vice President of Global Affairs, OpenAI

"Anthropic 相信 AI 有潜力从根本上改变世界的运作方式。我们很高兴能够与行业、民间社会、政府和学术界合作,推动该技术的安全和负责任的发展。" — Dario Amodei, CEO, Anthropic

"我们——很兴奋能够与其他领先的公司合作,共享技术专长以推进负责任的 AI 创新。" — Kent Walker, President, Global Affairs, Google & Alphabet

Sources