OpenAI 安全与保障实践更新
OpenAI 已将其安全与保障委员会(SSC)转变为独立的董事会监督委员会,以在模型开发和部署期间管理关键的安全与保障措施。此举建立了对模型发布进行独立监督的正式机制,包括在安全问题得到解决之前延迟发布的权力。
独立治理与董事会监督
安全与保障委员会现在将作为独立的董事会监督委员会运作。委员会由卡内基梅隆大学机器学习系主任 Zico Kolter 主持,成员包括 Quora CEO Adam D’Angelo、退休的美国陆军将军 Paul Nakasone,以及前索尼公司执行副总裁兼总法律顾问 Nicole Seligman。
关键职责包括:
- 模型发布监督:委员会和全体董事会对模型发布进行监督。如果安全问题未得到解决,他们有权延迟发布。
- 技术简报:公司领导向委员会提供重大模型发布的安全评估。委员会定期收到关于当前和未来模型的技术评估以及发布后监控的报告。
- 运营参与:委员会与 OpenAI 的内部安全与保障团队保持定期互动。
加强网络安全措施
OpenAI 正在采用基于风险的网络安全方法,以保护先进的 AI 研究和产品基础设施。目前的举措包括:
- 基础设施安全:扩大内部信息分段,并增加全天候安全运营团队的人员配置。
- 行业合作:评估为 AI 行业创建信息共享与分析中心(ISAC),以促进 AI 实体之间的威胁情报和网络安全信息共享。
透明度与外部合作
OpenAI 正在通过以下渠道扩大其透明度工作以及对安全系统的第三方验证:
透明度报告
OpenAI 继续发布其模型的系统卡,例如 GPT-4o 和 o1-preview 的系统卡,详细说明了功能、风险、外部红队测试结果以及在准备框架下进行的前沿风险评估。
外部合作伙伴关系
- 独立测试:公司正在与非政府实验室和第三方安全组织开展合作,以进行独立的模型安全评估。
- 政府合作:OpenAI 正在与美国和英国的 AI 安全研究所合作,研究新兴风险和可信 AI 的标准。它还与洛斯阿拉莫斯国家实验室合作,研究 AI 在生物科学研究环境中的安全使用。
开发统一安全框架
OpenAI 正在实施一个集成的安全与保障框架,为模型发布设定明确的成功标准。该框架基于风险评估,必须经安全与保障委员会批准。
为支持该框架,OpenAI 已重组其研究、安全和政策团队,以确保组织内部更紧密的协作和更强的联系。该框架旨在随着模型能力和复杂性的提升而进行适配。