OpenAI 使用 AI 破壞國家屬性威脅行動者
OpenAI 已終止了五名試圖利用其 AI 服務從事惡意網路活動的國家屬性威脅行動者的帳戶。這些發現顯示,儘管國家行動者正嘗試利用 AI,但相較於現有的非 AI 工具,當前模型在網路安全任務上僅提供有限且漸進的能力。
破壞國家屬性行動者
OpenAI 與 Microsoft Threat Intelligence 識別並破壞了五名特定的國家屬性行動者。受影響的帳戶已在以下群組中被終止:
- 中國: Charcoal Typhoon 與 Salmon Typhoon
- 伊朗: Crimson Sandstorm
- 北韓: Emerald Sleet
- 俄羅斯: Forest Blizzard
這些行動者主要利用 OpenAI 服務執行基本任務,例如查詢開源資訊、翻譯、尋找程式碼錯誤,以及執行基礎程式編寫任務。
各行動者的具體活動
每個群組利用 AI 工具達成不同的策略目標:
- Charcoal Typhoon: 專注於研究公司與網路安全工具、除錯程式碼、產生腳本,以及為網路釣魚活動製作內容。
- Salmon Typhoon: 使用服務翻譯技術論文、取得情報機構與區域威脅行動者的公開資訊、協助程式編寫,並研究系統上隱藏程序的方法。
- Crimson Sandstorm: 利用平台提供應用程式與網站開發腳本支援、產生魚叉式網路釣魚內容,並研究惡意軟體偵測規避方式。
- Emerald Sleet: 辨識亞太地區的防禦專家與組織、研究公開漏洞、執行基礎腳本編寫,並草擬網路釣魚內容。
- Forest Blizzard: 主要進行開源研究,聚焦雷達影像技術與衛星通訊協定,同時提供腳本支援。
AI 在網路安全任務中的能力
此項破壞的發現與 OpenAI 及外部專家先前進行的紅隊評估相符。這些評估得出結論,GPT-4 在惡意網路安全任務上僅提供有限且漸進的能力,無法超越已公開可取得的非 AI 工具所能達成的範圍。
OpenAI 多管齊下的安全策略
為了對抗日益演變的國家屬性濫用威脅,OpenAI 採用四部分的安全框架:
監控與破壞
OpenAI 動用專門的情報與調查、安全、安保與完整性團隊,以識別高度複雜的威脅行動者。這些團隊使用 OpenAI 自家的模型分析對手互動並評估其意圖。被偵測到的行動者將面臨帳戶停用、服務終止或資源限制。
生態系統合作
OpenAI 與產業夥伴及相關利害關係人合作,交流有關國家屬性行動者使用 AI 的偵測資訊。此舉是自願承諾的一部分,旨在促進 AI 技術的安全與透明發展。
迭代式安全緩解措施
實際濫用資料被用來指導安全防護的迭代開發。透過分析高度複雜的行動者如何嘗試濫用系統,OpenAI 能辨識可能廣泛出現的模式,從而持續演進模型防護措施。
公開透明
OpenAI 保持在必要時向公眾與利害關係人說明偵測到的惡意國家屬性活動的性質與範圍的政策。其目標是促進集體防禦,提升所有利害關係人的意識。