OpenAI Aardvark: 具代理能力的安全研究員
OpenAI 已宣布 Aardvark,一種由 GPT-5 驅動的具代理能力的安全研究員。Aardvark 的設計旨在協助開發者與安全團隊大規模發現並修復軟體漏洞,將軟體安全的平衡傾向防禦方。
Aardvark 的漏洞發現技術方法
Aardvark 不依賴傳統的程式分析技術,例如軟體成分分析或模糊測試。相反地,它使用由 LLM 驅動的推理與工具使用,以類似人類安全研究員的方式分析程式碼行為——閱讀程式碼、分析它並執行測試。
為了識別並解決漏洞,Aardvark 採用多階段管線:
- Analysis: 代理首先分析完整的儲存庫,根據專案的設計與安全目標建立威脅模型。
- Commit Scanning: Aardvark 會針對儲存庫與既定威脅模型監測提交層級的變更。對於新儲存庫,它會掃描完整歷史以識別現有問題。發現將以帶有註解程式碼的逐步說明形式呈現,供人工審閱。
- Validation: 為了減少誤報,Aardvark 會嘗試在隔離的沙箱環境中觸發已識別的漏洞,以確認其可利用性。
- Patching: Aardvark 與 OpenAI Codex 整合以生成補丁。每個發現都會附帶一個由 Codex 生成且經 Aardvark 掃描的補丁,以供人工審閱者進行高效的一鍵補丁。
除了安全漏洞之外,測試顯示 Aardvark 也能識別邏輯缺陷、隱私問題以及未完成的修復。
效能與真實世界影響
Aardvark 已部署在 OpenAI 內部的程式碼基礎以及外部的 alpha 合作夥伴。在「黃金」儲存庫的基準測試中,Aardvark 識別出 92% 的已知及合成引入的漏洞。
在開源生態系統中,Aardvark 已經發現眾多漏洞,其中十個已被分配 Common Vulnerabilities and Exposures (CVE) 識別碼。為了支援開源供應鏈,OpenAI 計畫為選定的非商業開源儲存庫提供免費掃描服務。
系統風險與防禦優先模型
軟體漏洞構成對全球基礎設施的系統性風險,2024 年報告的 CVE 超過 40,000 個。OpenAI 指出,約有 1.2% 的提交會引入錯誤,這些小變更會帶來顯著風險。
Aardvark 透過在程式碼演進過程中提供持續保護來實施防禦優先模型。透過與 GitHub、Codec 以及現有開發工作流程整合,其目標是在不影響創新速度的情況下加強安全。
可用性與演進
Aardvark 初期以私人測試版形式針對選定合作夥伴推出,以提升偵測準確度與報告品質。截至 2026 年 3 月 6 日,Aardvark 已演變為 Codex Security,該版本目前以研究預覽版提供。Codex Security 直接整合至 Codex,並將透過 Codex web 推出至 ChatGPT Enterprise、Business 與 Edu 客戶。