GPT-5.6 Sol 預覽:功能、防護與可用性

GPT-5.6 Sol 預覽:功能、防護與可用性

概述

OpenAI 宣布了 GPT‑5.6 Sol 的有限預覽,這是 GPT‑5.6 系列的旗艦模型,連同 Terra 和 Luna 模型一起,以在更廣泛發布之前評估性能與安全。

功能

GPT‑5.6 Sol 在編碼、生物學和網路安全工作流程中提供了目前最強的性能。它在 Terminal‑Bench 2.1 上設定了新的最先進狀態,使用更少的標記在 GeneBench v1 上改進了結果,並在 ExploitBench 和 ExploitGym 上展現了競爭力的結果,同時輸出比先前模型更少。該模型引入了一個新的 max 推理努力,以進行更深入的單一代理推理,以及一個 ultra 模式,該模式使用子代理來加速複雜工作。

防護措施

此版本將提升的功能與一個分層的防護堆疊結合,旨在遏制被禁止的進攻性網路活動,同時保留合法的防禦工作。防護措施包括模型級別的拒絕訓練、實時濫用分類器、帳號級別審查、差異化存取、監控與執行,全部經過自動紅隊測試(超過 700,000 個 A100 等效 GPU 小時)和人類專家測試的壓力測試。在 Preparedness Framework 下,GPT‑5.6 Sol 未越過 Cyber Critical 門檻。在預覽期間,防護措施可能會阻擋或延遲請求,並將使用回饋來減少不必要的干擾。

可用性與定價

最初,GPT‑5.6 Sol、Terra 和 Luna 將透過 API 和 Codex 提供給一組受信任的合作夥伴;未來幾週計畫透過 ChatGPT、Codec 和 API 實現更廣泛的可用性。每 1M token 的定價為:Sol:輸入 $5 / 輸出 $30,Terra:輸入 $2.50 / 輸出 $15,Luna:輸入 $1 / 輸出 $6。Terra 的性能與 GPT‑5.5 具競爭力,但成本僅為其一半;Luna 則以最低成本提供強大能力。該版本還引入了更可預測的提示快取,具有明確的斷點以及最少 30 分鐘的快取生命週期,其中快取寫入成本為未快取輸入速率的 1.25 倍,快取讀取可享受 90% 的折扣。GPT‑5.6 Sol 將於 7 月起在 Cerebras 硬體上運行,最高可達每秒 750 個 token,最初僅提供給選定客戶。

Summary: OpenAI 預覽了 GPT-5.6 Sol,其旗艦次世代模型,連同 Terra 和 Luna 一起,強調了更強的編碼、生物學和網路安全能力,並附有增強的防護措施以及對受信任合作夥伴的有限發布。

Title: GPT-5.6 Sol 預覽:功能、防護與可用性

Sources