OpenAI 对治理具备代理性的 AI 系统的实践
TL;DR
OpenAI 引入了一套治理具备代理性的 AI 系统的实践框架,以确保这些系统能够负责任地融入社会。该框架旨在为参与代理性 AI 生命周期的所有方建立基础责任和安全最佳实践,从而在降低伤害风险的同时,实现有限监督下复杂目标追求的效率和效能。
定义具备代理性的 AI 系统
具备代理性的 AI 系统被定义为能够在有限直接监督下追求复杂目标的 AI 系统。这些系统有潜力帮助用户更高效、更有效地实现其目标,但其自主性也增加了潜在伤害的风险。
治理框架与生命周期责任
为管理具备代理性的 AI 所带来的风险,OpenAI 建议治理应聚焦于明确参与代理性 AI 系统生命周期各方的角色与责任。这包括为每一方商定一套基础责任和安全最佳实践,以确保运营安全和问责制。
将安全实践落地
OpenAI 指出,虽然已经提供了保持代理运行安全和可问责的初步实践,但在这些实践的落地方面仍存在重大不确定性和疑问。必须先解决这些问题,才能将实践编入正式标准。
大规模采用的间接影响
除了单个代理的直接运营安全外,具备代理性的 AI 系统的大规模采用预计会产生间接影响。OpenAI 认为,这些影响可能需要制定更广泛的治理框架,以管理自主 AI 代理在社会中的系统性效应。
研究资助计划
OpenAI 启动了研究资助计划,向研究具备代理性的 AI 系统影响及其安全实践的项目提供 10,000 至 100,000 美元的资助。(注:该资助计划现已结束)。