OpenAI 打擊 AI 惡意使用 2025 年 10 月更新
OpenAI 自 2024 年 2 月以來已打斷並通報超過 40 個違反其使用政策的網路。此項努力旨在防止威權政權利用 AI 進行人口控制或國家強迫,同時減輕詐騙、惡意網路活動與隱蔽影響作業的風險。
AI 整合於威脅行動者的作戰手冊
威脅行動者目前正將 AI 整合到現有的攻擊方法中,以提升作業速度,而非利用模型創造全新的攻擊能力。OpenAI 觀察到 AI 正被「套在舊的作戰手冊上」,使惡意行動者能更快速行動。
偵測與緩解策略
OpenAI 透過帳號執行與資訊共享的結合來打斷惡意活動。當偵測到使用政策違規時,公司會採取以下行動:
- 帳號封禁:發現從事違規活動的帳號將被封禁。
- 合作夥伴協作:適當情況下,將威脅行動者行為的見解與合作夥伴分享。
- 公開報告:OpenAI 發布威脅情報報告,以提升對濫用的認識並加強對一般使用者的保護。
被打斷活動的範圍
打斷行動針對以下幾類具體的惡意使用:
- 與國家相關的威脅:防止威權政權利用 AI 施壓其他國家或控制其自身人口。
- 網路活動:打斷惡意的網路行動。
- 影響作業:識別並阻止隱蔽的影響作業。
- 金融詐騙:防止使用 AI 進行詐騙。
OpenAI 主張,這些行動是其更廣泛使命的一部分,旨在確保通用人工智慧造福全人類,透過建立以常識規則為基礎、保護使用者免受實際危害的民主 AI。