OpenAI 為 AI 下一階段發展建立標準
OpenAI 已宣布一項提案,旨在建立全球性的前沿 AI 開發技術標準。此項倡議旨在確保當 AI 系統在自身研究與開發中變得更加自主時——這過程稱為遞歸自我改進(RSI)——仍能與人類價值觀保持一致並處於人類控制之下。
遞歸自我改進(RSI)與 AI 研究
自動化 AI 研究使 AI 系統能承擔部分開發下一代 AI 所需的工作。此遞歸自我改進(RSI)的過程可隨著自動化程度提高而迅速加速 AI 的進展。
OpenAI 指出 RSI 可能帶來的若干潛在好處與風險:
- 好處: 自動化 AI 研究可降低先進智慧的開發成本,提升人們的生活品質,並作為自動化的 AI 安全研究者,以改善對齊性並建立防禦機制以應對有能力的 AI。
- 風險: 完全自主的 RSI 可能導致人類失去對 AI 開發的實際控制,進而產生更危險且對齊性更差的系統。OpenAI 表示,除非能確保安全,否則不應追求完全自主的 RSI。
國際標準的必要性
OpenAI 認為,國際標準是防止碎片化、解決集體行動問題,並應對各國能力不均的必要手段。若缺乏對高品質證據的共同定義以及技術防護基準的共識,將可能導致「向下競爭」的風險,即各國各自行動,甚至忽略安全防護措施。
這些挑戰同時適用於開放模型與封閉模型的開發者。OpenAI 強調,儘管實驗室必須對安全負起個人責任,但國際標準能為外部利益相關者提供參與技術發展的途徑。
全球標準的建議框架
OpenAI 建議由美國領導,與其他國家合作制定這些全球性技術標準。所提出的框架包含兩個主要組成部分:
1. 補充性國家與國際標準的機制
OpenAI 建議利用現有的 AI 安全研究所網絡(包括澳洲、加拿大、德國、法國、肯亞、日本、韓國、新加坡、印度與英國的機構)以及 AI 標準與創新中心(CAISI)。此努力將聚焦於以能力基準衡量的前沿 AI 模型與開發者,並針對自動化 AI 研究的風險與效益管理。
這些標準的關鍵特徵包括:
- 技術基礎: 提供能力測量、風險評估與防護足夠性的共同基礎。
- 非約束性: 這些標準不會是許可證或強制性的預發行審查。各國政府將自行決定如何將其納入自身法律體系。
- 包容性發展: 過程應徵詢開放與封閉模型開發者、學術界與獨立專家的意見,以確保標準不會偏袒特定公司或商業模式。
2. 共同測量指標與事件通報協議
為管理 AI 研究日益增加的自主性,OpenAI 提出以下標準:
- RSI 相關進展的評估: 衡量企業內部自主研究的規模。
- 人類監督: 定義哪些自動化研究流程應觸發即時的人類審查。
- 主權溝通: 建立政府與關鍵基礎設施運營者之間的安全通訊管道,以分享國家安全疑慮與新出現的漏洞。
美國的戰略定位
OpenAI 認為,控制 AI 發展的節奏在於確保對齊研究能領先於能力進展。他們主張美國在這項努力中具有獨特優勢,因其 AI 產業處於技術前沿,且在全球金融、貿易與防務領域擁有特權地位。領導此項工作,可讓美國塑造全球 AI 框架,而非被動應對一個碎片化且充滿衝突的體系。