GPT-4o mini 發布說明 / 有什麼新功能
OpenAI 推出了 GPT-4o mini,一款成本效益高的小型模型,旨在讓高性能 AI 更加負擔得起且更易取得。該模型定位為 GPT-3.5 Turbo 的替代方案,提供更優秀的文字智慧與多模態推理,且價格顯著更低。
技術規格與功能
GPT-4o mini 是一款多模態模型,在 API 中支援文字與視覺,未來計畫支援影像、影片與音訊的輸入與輸出。它具備 128K 令牌的上下文視窗,且每次請求可支援最高 16K 輸出令牌。模型的知識截止時間為 2023 年 10 月。
主要技術優勢包括:
- 改進的分詞器:與 GPT-4o 共享,此分詞器使處理非英語文字更具成本效益。
- 長上下文效能:相較於 GPT-3.5 Turbo,該模型在長上下文情境中展現出提升的效能。
- 函式呼叫:在函式呼叫方面的強大效能,使開發者能構建與外部系統互動以取得資料或執行動作的應用程式。
效能基準測試
GPT-4o mini 在多項學術基準測試中超越 GPT-3.5 Turbo 及其他小型模型:
推理與文字智慧
GPT-4o mini 在 MMLU 上取得 82.0% 的分數,超過 Gemini Flash(77.9%)與 Claude Haiku(73.8%)。
數學與程式設計
- MGSM(數學推理):GPT-4o mini 取得 87.0% 的分數,Gemini Flash 為 75.5%,Claude Haiku 為 71.7%。
- HumanEval(程式設計):GPT-4o mini 取得 87.2% 的分數,Gemini Flash 為 71.5%,Claude Haiku 為 75.9%。
多模態推理
在 MMMU 基準測試中,GPT-4o mini 取得 59.4% 的分數,超過 Gemini Flash(56.1%)與 Claude Haiku(50.2%)。
成本與可用性
GPT-4o mini 的成本比先前的前沿模型低一個量級,且比 GPT-3.5 Turbo 便宜超過 60%。定價為每百萬輸入令牌 0.15 美元,每百萬輸出令牌 0.60 美元。
可用性:
- API:現已在 Assistants API、Chat Completions API 與 Batch API 中提供。
- ChatGPT:立即對免費、Plus 與 Team 用戶開放;Enterprise 用戶將於下週起取得存取權。
- 微調:計畫在未來幾天內推出。
安全性與保安
安全性已透過預訓練過濾(移除仇恨言論、成人內容與垃圾訊息)以及使用人類回饋的強化學習(RLHF)進行後訓練對齊,整合於開發流程中。
GPT-4o mini 是首個採用 指令層級 方法的模型,該方法提升了模型抵抗 jailbreak、提示注入與系統提示抽取的能力,使其在大規模應用中更為可靠。
使用案例與產業應用
低成本與低延遲使 GPT-4o mini 適用於串接或平行多次模型呼叫、傳遞大量上下文(例如完整程式碼庫)或提供即時客服聊天機器人的應用。Ramp 與 Superhuman 等合作夥伴發現,該模型在從收據提取結構化資料或根據郵件串歷史生成高品質回覆方面,表現遠優於 GPT-3.5 Turbo。