GPT-5 系统卡片补充:敏感对话

OpenAI 发布了 GPT-5 系统卡片的补充说明,详细阐述了模型在处理涉及心理和情感困境的敏感对话时的改进。通过与超过 170 名心理健康专家合作,OpenAI 将低于预期安全行为的响应减少了 65-80%。

模型更新与安全改进

2025 年 10 月 3 日,OpenAI 部署了对 ChatGPT 默认模型的更新,以增强其识别困境迹象并提供支持性、关怀导向响应的能力。此更新侧重于引导用户走向现实世界的支持系统,而不是在敏感情境下提供不足或不适当的响应。

基线安全评估

为了衡量更新的效果,OpenAI 将模型的 10 月 3 日版本与 ChatGPT 默认模型的 8 月 15 日版本(称为 GPT-5 Instant)进行了比较。由此得到的评估作为模型在处理敏感对话时性能提升的基线。

专家合作

这些安全改进是在与超过 170 名心理健康专家合作的情况下开发的。此次合作确保了模型的响应更可靠地符合识别和支持经历情感困境个体的专业标准。

Sources