OpenAI GPT-5.5 系统卡

OpenAI GPT-5.5 系统卡

OpenAI 已发布 GPT-5.5,这是一个专为复杂的真实世界工作而设计的模型,例如编码、在线研究和跨工具编排。此次发布标志着向需要较少指导、更有效地使用工具以及能够自主检查自身工作以完成任务的模型转变。

模型能力和任务执行

GPT-5.5 经过设计,可实现高自主性任务完成。与之前的版本相比,该模型在流程早期展示出对任务理解能力的提升,并且需要较少的用户指导即可达到目标。主要能力包括:

  • 复杂工作流编排: 模型可以编写代码、进行在线研究、分析信息,并生成文档和电子表格。
  • 工具集成: GPT-5.5 能更有效地使用工具,在不同应用之间移动以实现目标。
  • 自我纠正: 模型被设计为检查自身工作,并在任务完成前持续进行。

安全框架和预部署评估

OpenAI 对 GPT-5.5 进行了全面的安全套件评估,包括准备框架和完整的预部署安全评估。为了降低与高级能力相关的风险,该模型特别进行了针对网络安全和生物学的定向红队测试。

在正式发布之前,OpenAI 收集了近 200 家早期访问合作伙伴的反馈,以评估模型在真实世界使用案例中的表现。

GPT-5.5 与 GPT-5.5 Pro

OpenAI 区分了 GPT-5.5 和 GPT-5.5 Pro。GPT-5.5 Pro 使用相同的底层模型,但采用了一种利用并行测试时间计算的设置。由于此特定设置可能对风险或必要的防护姿态产生实质性影响,OpenAI 在某些情况下会单独评估 GPT-5.5 Pro。

一般来说,GPT-5.5 的安全结果可以作为 GPT-5.5 Pro 安全状况的强有力代理。

部署防护措施

OpenAI 正在以迄今为止最强的一套防护措施部署 GPT-5.5。这些措施旨在降低滥用的潜在风险,同时确保模型的高级能力仍可用于合法和有益的用途。

Sources