OpenAI GPT-5.5 版本說明
OpenAI 已發布 GPT-5.5 與 GPT-5.5 Pro,標誌著向具備規劃與執行跨多種軟體工具之多部份任務能力的代理式 AI 轉變。這些模型在程式編寫與知識工作方面提供更高的智慧與改進的 token 效率,且相較於 GPT-5.4,單 token 延遲未增加。
代理式程式編寫與軟體工程
GPT-5.5 被設計為高自治性的程式模型,能管理複雜、長期的工程任務。它在理解系統架構、推理模糊失敗以及在大型程式碼庫中保持上下文方面展現更強的能力。
效能基準
- Terminal-Bench 2.0: 在複雜的命令列工作流程中達到 82.7% 的正確率。
- SWE-Bench Pro: 在解決真實的 GitHub 問題上達到 58.6%。
- Expert-SWE (Internal): 在中位人類完成時間為 20 小時的任務上優於 GPT-5.4。
真實應用
早期測試者報告概念清晰度有顯著提升。例如,模型在 20 分鐘內成功完成一次涉及數百個前端與重構變更的複雜分支合併。來自 NVIDIA 與 Cursor 的使用者指出,它的持續性與在未明確提示下預測測試與審查需求的能力令人印象深刻。
知識工作與電腦使用
GPT-5.5 更好地結合了意圖理解與電腦使用能力,能在介面間導航、點擊、輸入文字,並在多種工具間移動以完成知識工作迴路。
專業基準
- GDPval: 在 44 種職業的良好規範知識工作產出上取得 84.9% 的分數。
- OSWorld-Verified: 在自主操作真實電腦環境上達到 78.7%。
- Tau2-bench Telecom: 在未經提示微調的複雜客服工作流程中取得 98.0%。
內部部署
OpenAI 報告稱超過 85% 的員工每週使用 Codex。使用案例包括財務團隊審查超過 71,000 頁的 K-1 稅表(將任務加速兩週)以及傳訊團隊透過 Slack 代理自動化低風險的發言請求處理。
科學研究與數學發現
GPT-5.5 作為「共同科學家」,在探索想法、收集證據與解釋結果的迭代循環中持續參與。
技術成就
- 數學證明: 內部版本的 GPT-5.5 發現了組合學中關於非對角 Ramsey 數的新證明,後續在 Lean 中得到驗證。
- 生物資訊: 模型在 BixBench 上取得領先表現,且在 GeneBench 上相較於 GPT-5.4 有顯著提升,特別是在遺傳學的多階段科學資料分析上。
- 自訂工具: 研究人員使用模型在數分鐘內從單一提示構建複雜的代數幾何應用,並可視化二次曲面交集。
推論效能與基礎設施
GPT-5.5 共同設計並在 NVIDIA GB200 與 GB300 NVL72 系統上訓練。為了維持 GPT-5.4 的延遲水平,OpenAI 使用模型本身優化了推論堆疊。
Codex 被用來分析生產流量模式,並撰寫自訂的啟發式負載平衡與分割演算法。此優化使 token 產生速度提升超過 20%。
網路安全與安全框架
OpenAI 在其備援框架下將 GPT-5.5 的生物、化學與網路安全能力分類為「高」,但未達到「關鍵」等級的網路安全層級。
安全措施
- 更嚴格的分類器: 部署時對高風險活動與敏感的網路請求實施更緊的控制。
- 可信存取 for Cyber: 經驗證的使用者與防護關鍵基礎設施的組織可申請「cyber-permissive」模型(如 GPT-5.4-Cyber),以減少合法防禦工作中的摩擦。
- 治理: 模型經過完整的安全處理,包括紅隊測試與針對先進生物與網路安全的目標測試。
可用性與定價
存取方式
- ChatGPT: GPT-5.5 可供 Plus、Pro、Business 與 Enterprise 用戶使用。GPT-5.5 Pro 可供 Pro、Business 與 Enterprise 用戶使用。
- Codex: 可供 Plus、Pro、Business、Enterprise、Edu 與 Go 計畫使用,具備 400K 上下文視窗。
- API: GPT-5.5 與 GPT-5.5 Pro 已於 2026 年 4 月 24 日起在 API 中提供。
API 定價
| 模型 | 輸入 (每 1M token) | 輸出 (每 1M token) | 上下文視窗 |
|---|---|---|---|
| gpt-5.5 | $5 | $30 | 1M |
| gpt-5.5-pro | $30 | $180 | 1M |
批次與彈性定價為標準費率的 50%,而優先處理為標準費率的 2.5 倍。
SUMMARY: OpenAI 已發布 GPT-5.5 與 GPT-5.5 Pro,於代理式程式編寫、電腦使用與科學研究方面帶來重大進步,同時保持 GPT-5.4 的延遲表現。
TITLE: OpenAI GPT-5.5 版本說明
Sources
- OriginalIntroducing GPT-5.5