OpenAI GPT-5.2-Codex 系統卡補遺

OpenAI 已發布 GPT-5.2-Codex,這是一個針對代理式編碼而優化的 GPT-5.2 專屬版本。該模型設計用於複雜、真實世界的軟體工程,包括專案規模的重構、遷移,以及在 Windows 環境中的效能提升。

技術改進與能力

GPT-5.2-Codex 專注於長期任務與專案規模的軟體工程。主要技術增強包括:

  • Context Compaction: 模型使用上下文壓縮來提升處理長期任務的能力。
  • Project-Scale Tasks: GPT-5.2-Codex 在大型工程任務(如程式碼庫重構與遷移)上展現更強的效能。
  • Environment Optimization: 模型在 Windows 環境中顯示出特別提升的效能。
  • Cybersecurity: 與先前版本相比,模型具備顯著更強的網路安全能力。

安全性與緩解策略

OpenAI 實施了一套完整的安全措施,以確保模型的安全部署。這些措施分為模型層級與產品層級的緩解措施:

  • Model-Level Mitigations: 包括專門的安全訓練,以防止模型協助有害任務並抵抗提示注入。
  • Product-Level Mitigations: 包括代理沙箱與可設定的網路存取,以限制濫用的可能性。

備援框架評估

GPT-5.2-Codex 依據 OpenAI 的備援框架進行評估,以衡量其關鍵風險門檻。評估結果如下:

  • Cybersecurity: 模型在網路安全領域被描述為「非常有能力」,但尚未達到「高能力」門檻。OpenAI 預期模型在不久的將來能跨越此門檻。
  • Biology: 模型在生物領域被視為具備「高能力」,與 GPT-5 系列的其他模型一致,並配備相應的防護措施。
  • AI Self-Improvement: 模型未達到 AI 自我改進的「高能力」門檻。

Sources