GPT-5.2-Codex 發佈說明

OpenAI 已發布 GPT-5.2-Codex,這是 GPT-5.2 的專門版本,針對 Codex 環境中的代理式編程進行了優化。此模型旨在處理複雜的真實世界軟體工程任務,包括大規模重構與遷移,同時提供顯著增強的資安能力。

先進的代理式軟體工程

GPT-5.2-Codex 在長期工作與終端環境的可靠性上超越了 GPT-5.2 與 GPT-5.1-Codex-Max 的能力。該模型旨在成為延長編程會話的可靠夥伴,確保完整上下文的維持至關重要。

主要技術改進

  • 上下文壓縮: 模型使用原生壓縮,在推理過程中保持代幣效率,同時提升長上下文的理解。
  • 工具呼叫與事實性: 在可靠的工具呼叫與事實性方面的改進,減少長時間任務中的錯誤。
  • 環境支援: 模型在原生 Windows 環境中運行時,展現出更高的效能與可靠性。
  • 視覺整合: 加強的視覺表現使模型能準確解讀技術圖表、圖形、使用者介面以及螢幕截圖,從而將設計模型轉換為功能原型。

效能基準測試

GPT-5.2-Codex 在兩項主要基準測試上達到最先進的效能:

  • SWE-Bench Pro: 測試模型在程式碼庫中產生修補程式以解決真實軟體工程任務的能力。
  • Terminal-Bench 2.0: 評估模型在真實終端環境中的代理式表現,包含設定伺服器、訓練模型與編譯程式碼等任務。

資安能力與雙重用途風險

與先前版本相比,GPT-5.2-Codex 在資安能力上有顯著提升。雖然根據 OpenAI 的備援框架,它尚未達到「高」等級的資安能力,但實驗室仍因其可能的雙重用途風險而謹慎部署。

真實世界漏洞研究應用

OpenAI 強調一個案例:安全研究員 Andrew MacPherson 使用 GPT-5.1-Codex-Max 發現了 React Server Components 中先前未知的漏洞。透過使用 Codex CLI 以及迭代式提示——包括建立本地測試環境與使用模糊測試探測系統——該研究員於 2025 年 12 月 11 日負責任地向 React 團隊披露了新漏洞。

安全與部署框架

為了在可及性與安全性之間取得平衡,OpenAI 正實施以下措施:

  • 逐步推出: 該模型已在所有 Codex 介面供付費 ChatGPT 用戶使用,API 存取預計於未來幾週開放。
  • 額外防護措施: 已將新防護機制整合至模型與產品,詳情請參閱系統卡。
  • 受信任存取試點: 正在為經審核的安全專業人士與組織試行邀請制計畫。此計畫為授權的防禦者提供更寬鬆的模型與進階功能,以加速防禦性資安工作,例如惡意程式分析與基礎設施壓力測試。

可用性摘要

存取層級 可用性
付費 ChatGPT 用戶 目前已在所有 Codex 介面提供
API 用戶 即將於未來幾週推出
經審核的專業人士 僅限邀請的受信任存取試點,供防禦性資安工作使用

Sources