OpenAI 对治理具备代理性的 AI 系统的实践

TL;DR

OpenAI 引入了一套治理具备代理性的 AI 系统的实践框架,以确保这些系统能够负责任地融入社会。该框架旨在为参与代理性 AI 生命周期的所有方建立基础责任和安全最佳实践,从而在降低伤害风险的同时,实现有限监督下复杂目标追求的效率和效能。

定义具备代理性的 AI 系统

具备代理性的 AI 系统被定义为能够在有限直接监督下追求复杂目标的 AI 系统。这些系统有潜力帮助用户更高效、更有效地实现其目标,但其自主性也增加了潜在伤害的风险。

治理框架与生命周期责任

为管理具备代理性的 AI 所带来的风险,OpenAI 建议治理应聚焦于明确参与代理性 AI 系统生命周期各方的角色与责任。这包括为每一方商定一套基础责任和安全最佳实践,以确保运营安全和问责制。

将安全实践落地

OpenAI 指出,虽然已经提供了保持代理运行安全和可问责的初步实践,但在这些实践的落地方面仍存在重大不确定性和疑问。必须先解决这些问题,才能将实践编入正式标准。

大规模采用的间接影响

除了单个代理的直接运营安全外,具备代理性的 AI 系统的大规模采用预计会产生间接影响。OpenAI 认为,这些影响可能需要制定更广泛的治理框架,以管理自主 AI 代理在社会中的系统性效应。

研究资助计划

OpenAI 启动了研究资助计划,向研究具备代理性的 AI 系统影响及其安全实践的项目提供 10,000 至 100,000 美元的资助。(注:该资助计划现已结束)。

Sources