OpenAI AI 安全合作框架

OpenAI 已確定了四項關鍵策略,旨在改善 AI 安全規範的長期產業合作,以防止競爭壓力導致集體行動問題,即企業在安全方面的投入不足。這種合作對於確保 AI 系統在變得日益強大時,仍能保持安全且有益至關重要。

改善 AI 安全合作的四項策略

為了增加遵守安全標準的可能性,OpenAI 提出了以下四項可行的策略:

1. 推動對合作的準確認知

產業參與者應溝通與 AI 相關的安全與保障風險,並將共同的擔憂轉化為常識。透過展示可以採取具體步驟來促進合作,企業可以使其對於互利機會的認知趨於一致。

2. 協作共享的研究與工程

企業應參與結合互補專業領域的跨學科聯合研究。當專注於那些其解決方案能為整個領域提供廣泛效用的研究與工程挑戰時,這種協作特別有效。

3. 增加透明度與監督

OpenAI 建議將 AI 開發的更多面向開放給適當的監督與回饋。這包括公開行為準則、增加與出版相關決策過程的透明度,並在解決知識產權與安全疑慮的前提下,允許對個別 AI 系統進行審查。

4. 激勵高安全標準

產業應支持經濟、法律或全產業範圍內的激勵機制,以遵守安全標準。這包括表彰遵循這些標準的組織,並譴責那些未能確保系統安全開發的組織。

解決集體行動問題

AI 產業中的競爭壓力可能會造成「集體行動問題」,即為了競爭優勢而偏離安全規範的誘因,超過了合作的誘因。OpenAI 主張,當安全開發的互利因素(例如防止 AI 失效與誤用)高於忽視安全的優勢時,合作的可能性會更高。

為了減少忽視安全預防措施的誘惑,OpenAI 建議:

  • 降低實施成本:降低實施安全措施的成本與難度,使合規變得更具吸引力。
  • 監管環境:政府可以建立一種監管環境,禁止違反高風險的安全標準。

建議的協作研究領域

OpenAI 主張應徹底梳理跨組織與跨國界的協作,特別專注於具有廣泛效用的領域,例如:

  • 形式化驗證 (Formal verification):針對 AI 系統能力以及其他安全與保障方面的形式化驗證進行聯合研究。
  • AI for good:在永續發展與健康等領域進行具有廣泛正面應用的應用型專案。
  • AI countermeasures:針對全球性威脅(例如網路上的合成媒體生成誤用)的共同開發對策措施。

Sources