OpenAI 前沿 AI 监管提案
OpenAI 和一组多学科研究者提出了一种针对“前沿 AI”的监管框架——这些高能力基础模型可能对公共安全构成严重风险。该提案认为,由于危险能力可能意外出现且一旦部署后难以遏制,政府干预和标准化的安全要求是平衡创新与公共安全所必需的。
前沿 AI 的监管挑战
前沿 AI 模型提出了三个使传统监督变得困难的不同挑战:
- 意外出现: 危险能力可能在模型中意外出现,使得在开发之前无法预测所有风险。
- 滥用潜力: 模型部署后,难以有效防止用户将其用于有害目的。
- 扩散: 一旦释放,阻止前沿模型能力广泛扩散具有挑战性。
提议的监管基础模块
为了应对这些风险,作者提出了前沿 AI 监管的三个主要基础模块:
- 标准制定流程: 建立正式流程以识别和定义前沿 AI 开发者适当的安全和安全要求。
- 注册和报告: 实施要求,让开发者注册其模型并报告其开发过程,以便监管者获得必要的可见性。
- 合规机制: 创建系统以确保开发者在开发和部署两个阶段都遵守既定的安全标准。
治理和执行选项
虽然行业自律被视为必要的第一步,但作者指出,政府干预是创建具有约束力的标准并确保合规所必需的。执行的提出选项包括:
- 监管机构: 赋予专门监管机构执行权力。
- 许可制度: 为前沿 AI 模型的开发和部署实施许可要求。
前沿 AI 的初步安全标准
该提案概述了一套初步的安全标准,开发者应遵循以降低风险:
- 部署前风险评估: 在模型发布之前进行潜在风险的彻底评估。
- 外部审查: 将模型行为提交给外部审查和分析。
- 外部风险知情部署: 使用风险评估结果直接为部署决策提供信息和指导。
- 部署后监控: 在模型部署后,持续监控并响应有关模型能力和用途的新信息。