OpenAI GPT-5.4 mini 與 nano 發布說明
OpenAI 已發布 GPT-5.4 mini 和 nano,這兩款小型模型旨在為高容量工作負載提供 GPT-5.4 系列的推理與多模態能力。這些模型以速度與成本效益為優先,適用於低延遲對使用者體驗至關重要的應用。
GPT-5.4 mini:高效能與效率
GPT-5.4 mini 為需要速度與智慧平衡的專業任務而設計。其運行速度比 GPT-5 mini 快超過兩倍,且在多項關鍵評測(包括 OSWorld-Verified 與 SWE-Bench Pro)上接近完整 GPT-5.4 模型的表現。
效能基準
GPT-5.4 mini(高推理努力)相較於其前身 GPT-5 mini(高推理努力)展現出顯著提升:
- Coding: 在 SWE-Bench Pro(公開)上為 54.4%,相較於 GPT-5 mini 的 45.7%。
- Computer Use: 在 OSWorld-Verified 上為 72.1%,幾乎與 GPT-5.4 的 75.0% 相當。
- General Intelligence: 在 GPQA Diamond 上為 88.0%,相較於 GPT-5 mini 的 81.6%。
- Tool Use: 在 Toolathlon 上為 42.9%,在 τ2-bench(電信)上為 93.4%。
多模態與電腦使用能力
GPT-5.4 mini 針對多模態任務進行了最佳化,特別是對密集使用者介面的解讀。它能快速處理螢幕截圖以執行電腦使用任務,於 OSWorld-Verified 基準測試上大幅超越 GPT-5 mini。
GPT-5.4 nano:為低成本任務最佳化
GPT-5.4 nano 是 GPT-5.4 系列中最小且最具成本效益的版本。建議用於高容量、較簡單的支援任務,例如:
- 分類
- 資料抽取
- 排序
- 處理簡單任務的程式碼子代理
在 GPQA Diamond 基準測試中,GPT-5.4 nano 達到 82.8%,超過先前的 GPT-5 mini(81.6%)。
程式碼工作流程與子代理架構
mini 與 nano 兩種模型皆針對程式碼工作流程的快速迭代進行了最佳化,包括除錯迴圈、程式碼庫導覽與前端產生。
子代理模式
OpenAI 強調一種系統架構,較大的模型擔任協調者,較小的模型則作為執行者。在此模式中,類似 GPT-5.4 的模型負責高層規劃與最終判斷,同時將較窄的子任務(例如搜尋程式碼庫或審閱大型檔案)平行委派給 GPT-5.4 mini 子代理。此方法讓開發者能組合出在規模上快速執行且仍保有高層次推理品質的系統。
可用性與定價
GPT-5.4 mini 與 nano 可透過多種 OpenAI 平台取得,規格如下:
GPT-5.4 mini
- Availability: API、Codex 與 ChatGPT。
- API Features: 支援文字/影像輸入、工具使用、函式呼叫、網路搜尋、檔案搜尋、電腦使用與技能。具備 400k 上下文視窗。
- API Pricing: 每 1M 輸入 token $0.75 / 每 1M 輸出 token $4.50。
- Codex Integration: 在應用程式、CLI、IDE 擴充與網頁皆可使用。使用 GPT-5.4 配額的 30%,將較簡單的程式碼任務成本降低約三分之二。
- ChatGPT Integration: 透過「Thinking」功能提供給 Free 與 Go 用戶;對其他用戶則作為 GPT-5.4 Thinking 的速率限制備援。
GPT-5.4 nano
- Availability: 僅限 API。
- API Pricing: 每 1M 輸入 token $0.20 / 每 1M 輸出 token $1.25。