GPT-5.6 Sol 预览:功能、防护措施和可用性

GPT-5.6 Sol 预览:功能、防护措施和可用性

概览

OpenAI 宣布了 GPT‑5.6 Sol 的有限预览,这是 GPT‑5.6 系列的旗舰模型,连同 Terra 和 Luna 模型一起,旨在在更广泛发布之前评估性能和安全性。

功能

GPT‑5.6 Sol 在编码、生物学和网络安全工作流中提供了迄今为止最强的性能。它在 Terminal‑Bench 2.1 上设定了新的最先进水平,在 GeneBench v1 上使用更少的令牌改进了结果,并且在使用比先前模型更少的输出的情况下,在 ExploitBench 和 ExploitGym 上表现出竞争力的结果。该模型引入了新的 max 推理工作量,以实现更深层的单智能体推理,以及一个 ultra 模式,该模式使用子智能体来加速复杂工作。

防护措施

此次发布将增强的能力与分层防护栈相结合,旨在遏制被禁止的进攻性网络活动,同时保留合法的防御工作。防护措施包括模型级拒绝训练、实时滥用分类器、账户级审查、差异化访问、监控和执行,所有这些均通过自动化红队测试(超过 700,000 个 A100‑等效 GPU 小时)和人工专家测试进行压力测试。在 Preparedness Framework 下,GPT‑5.6 Sol 未超过 Cyber Critical 阈值。在预览期间,防护措施可能会阻止或延迟请求,并且将使用反馈来减少不必要的干扰。

可用性和定价

最初,GPT‑5.6 Sol、Terra 和 Luna 将通过 API 和 Codex 向一组选定的可信合作伙伴提供;计划在未来几周通过 ChatGPT、Codex 和 API 实现更广泛的可用性。每 1M 令牌的定价为:Sol:输入 $5 / 输出 $30,Terra:输入 $2.50 / 输出 $15,Luna:输入 $1 / 输出 $6。Terra 的性能与 GPT‑5.5 相当,但成本仅为其一半;Luna 以最低成本提供强大的能力。该版本还引入了更可预测的提示缓存,具有明确的断点和最低 30 分钟缓存寿命,其中缓存写入成本为未缓存输入速率的 1.25 倍,缓存读取享受 90% 的折扣。GPT‑5.6 Sol 将从 7 月起在 Cerebras 硬件上运行,最高可达每秒 750 个令牌,最初仅面向选定客户。

Sources