OpenAI o3 和 o4-mini 发布说明
OpenAI o3 和 OpenAI o4-mini 是推理模型,将最先进的推理与全面的工具能力相结合,包括网页浏览、Python、图像和文件分析、图像生成、画布、自动化、文件搜索和记忆。这些模型旨在解决复杂的数学、编码和科学挑战,同时提供强大的视觉感知和分析能力。
思考链中的工具集成
OpenAI o3 和 o4-mini 通过在思考链中直接使用工具来增强其推理过程。这使得模型能够在内部审议过程中执行诸如裁剪或转换图像、搜索网络或运行 Python 代码分析数据等操作,然后再给出最终答案。
训练与安全对齐
o 系列模型使用大规模强化学习在思考链上进行训练。这种训练方法实现了“审议对齐”,使模型在响应可能不安全的提示时能够在上下文中推理安全政策,从而提升整体模型的鲁棒性和安全性。
准备框架与风险评估
此版本是首次在 OpenAI 准备框架第 2 版下进行评估。安全咨询组(SAG)审查了三个跟踪类别的评估:
- 生物和化学能力:模型未达到高风险阈值。
- 网络安全:模型未达到高风险阈值。
- 网络安全:模型未达到高风险阈值(AI 自我改进)。
OpenAI 报告称 o3 和 o3-mini 符合安全咨询组设定的安全阈值。