OpenAI治理具備代理性的 AI 系統的實踐
TL;DR
OpenAI 推出了一套治理具備代理性的 AI 系統的實踐框架,旨在確保此類系統能負責任地融入社會。此框架的目標是為參與代理性 AI 生命週期的所有相關方建立基礎責任與安全最佳實踐,以降低傷害風險,同時在有限監督下提升複雜目標追求的效率與效能。
定義具備代理性的 AI 系統
具備代理性的 AI 系統被定義為能在有限直接監督下追求複雜目標的 AI 系統。這類系統有助於使用者更高效、更有效地達成目標,但其自主性也提升了潛在傷害的風險。
治理框架與生命週期責任
為了管理具備代理性的 AI 所帶來的風險,OpenAI 認為治理必須聚焦於明確界定參與代理性 AI 系統生命週期各方的角色與責任。這包括為每一方協商一套基礎責任與安全最佳實踐,以確保運作安全與問責。
安全實踐的操作化
OpenAI 指出,雖然已提供了讓代理運作安全且負責的初步實踐,但在將這些實踐具體化為可操作的流程時仍存在重大不確定性與疑問。必須先解決這些問題,才能將實踐編入正式標準。
大規模採用的間接影響
除了個別代理的即時運作安全外,廣泛採用具備代理性的 AI 系統預計會產生間接影響。OpenAI 表示,這些影響可能需要制定更廣泛的治理框架,以管理自主 AI 代理在社會中的系統性效應。
研究補助計畫
OpenAI 發起了研究補助計畫,提供 10,000 至 100,000 美元的資金,資助針對具備代理性的 AI 系統影響及確保其安全所需實踐的研究。(註:此補助計畫現已結束)。