OpenAI 正為惡意使用 AI 做準備
OpenAI 正為惡意使用 AI 做準備 OpenAI 與其合作夥伴發表了一篇研究論文,預測 AI 可能被惡意行為者濫用的方式,並提供緩解這些全球安全威脅的建議。
OpenAI 正為惡意使用 AI 做準備
OpenAI 與 Future of Humanity Institute、Centre for the Study of Existential Risk、Center for a New American Security、Electronic Frontier Foundation 及其他合作夥伴共同合作,發表了一篇研究論文,預測惡意行為者可能濫用 AI 技術的潛在情況。此工作旨在提供一個框架,以預防和緩解因攻擊成本降低、新漏洞產生以及攻擊歸因難度增加而導致的全球安全威脅。
AI 作為全球安全挑戰
AI 技術構成安全風險,因為它降低了執行現有攻擊的成本,同時引入了新的漏洞,並使特定攻擊的歸因變得更加複雜。該報告將 AI 識別為雙用技術,意味著它既可用於極其正面的應用,也可用於極其負面的應用。
雙用特性與風險評估
因為 AI 工具既可用於公共利益,也可用於造成傷害,社區必須評估研究項目是否可能被惡意行為者濫用。雙用風險的例子包括:
- 監控工具:這些工具可用於抓捕恐怖分子,或壓迫普通公民。
- 資訊內容過濾器:這些過濾器可用於掩蓋假新聞,或操縱輿論。
為降低這些風險,該報告建議對特定研究進行發布前風險評估、選擇性地與可信組織分享敏感研究,並在科學界建立關於雙用問題的規範。
緩解策略與建議
該報告為公司、研究組織、從業者和政府提供了高層次的建議,以確保更安全的 AI 環境。
從網路安全實踐中學習
AI 研究者應該採用電腦安全社區的實踐來識別和預防威脅。建議的實踐包括:
- 紅隊演練:故意嘗試突破或顛覆系統以尋找弱點。
- 技術預測:投資於預測,以在威脅出現之前識別它們。
- 保密報告:建立慣例,以保密方式報告在 AI 系統中發現的漏洞。
擴大社會討論
由於 AI 將改變全球威脅格局,關於其安全與保安的討論必須涵蓋更廣泛的社會橫切面,包括國家安全專家、倫理學家、公民社會、企業以及普通大眾。
AI 濫用的具體情境
為了使理論風險具體化,該報告識別出幾個 AI 可能被濫用的具體情境:
- 目標說服:針對安全系統管理員的 AI 生成說服性廣告。
- 自動化網路攻擊:網路犯罪分子使用神經網絡和「模糊測試」技術,創造具備自動漏洞利用生成能力的電腦病毒。
- 自動化實體攻擊:黑客入侵清潔機器人,向 VIP 投放爆炸物有效載荷。
- 預測性監控:流氓國家使用增強 AI 的監控系統,基於預測風險檔案搶先逮捕人們。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch