GPT-5.2-Codex 发布说明
OpenAI 已发布 GPT-5.2-Codex,这是 GPT-5.2 的专用版本,针对 Codex 环境中的代理式编码进行优化。该模型旨在处理复杂的真实世界软件工程任务,包括大规模重构和迁移,同时提供显著增强的网络安全能力。
高级代理式软件工程
GPT-5.2-Codex 在 GPT-5.2 和 GPT-5.1-Codex-Max 的基础上进一步提升,专注于长期任务和终端环境中的可靠性。该模型旨在成为长时间编码会话中的可靠伙伴,确保完整上下文的保持至关重要。
关键技术改进
- 上下文压缩: 模型使用原生压缩,在推理过程中保持令牌效率,同时提升对长上下文的理解。
- 工具调用与事实性: 在可靠的工具调用和事实性方面的改进,降低了长期任务中的错误。
- 环境支持: 模型在原生 Windows 环境中运行时表现出更高的有效性和可靠性。
- 视觉集成: 增强的视觉性能使模型能够准确解读技术图表、图表、用户界面以及截图,从而将设计模型转化为功能原型。
性能基准
GPT-5.2-Codex 在两个主要基准上实现了业界领先的性能:
- SWE-Bench Pro: 测试模型在代码仓库中生成补丁以解决真实软件工程任务的能力。
- Terminal-Bench 2.0: 评估模型在真实终端环境中的代理性能,包括搭建服务器、训练模型和编译代码等任务。
网络安全能力与双重用途风险
与之前的版本相比,GPT-5.2-Codex 在网络安全能力上实现了显著跃升。虽然根据 OpenAI 的准备框架,它尚未达到“高”水平的网络能力,但实验室因其潜在的双重用途风险而对其部署保持谨慎。
实际漏洞研究中的应用
OpenAI 重点介绍了一个案例:安全研究员 Andrew MacPherson 使用 GPT-5.1-Codex-Max 发现了 React Server Components 中此前未知的漏洞。通过使用 Codex CLI 和迭代提示——包括搭建本地测试环境和使用模糊测试探测系统——该研究员在 2025 年 12 月 11 日负责任地向 React 团队披露了这些新漏洞。
安全与部署框架
为在可访问性与安全性之间取得平衡,OpenAI 正在实施以下措施:
- 逐步推出: 该模型已在所有 Codex 界面向付费 ChatGPT 用户开放,API 访问计划在未来几周内推出。
- 额外防护措施: 如系统卡所述,已在模型和产品中集成了新的防护措施。
- 可信访问试点: 正在为经过审查的安全专业人士和组织试点邀请制项目。该项目向授权防御者提供更宽松的模型和高级功能,以加速防御性安全工作,如恶意软件分析和基础设施压力测试。
可用性概述
| 访问层级 | 可用性 |
|---|---|
| 付费 ChatGPT 用户 | 当前已在所有 Codex 界面可用 |
| API 用户 | 将在未来几周内推出 |
| 经过审查的专业人士 | 仅限邀请的可信访问试点,面向防御性网络工作 |
Sources
- OriginalIntroducing GPT-5.2-Codex