OpenAI 更新 ChatGPT 安全与福祉举措

OpenAI 宣布了一项为期 120 天的重点计划,旨在改进 ChatGPT 对心理和情绪困扰迹象的识别和响应。此举通过整合专家医学指导、利用先进的推理模型,并为青少年用户引入特定保护措施,使 AI 在敏感时刻更加有帮助。

专家指导的安全框架

OpenAI 正在利用两个主要专家团队,以确保其福祉和心理健康响应基于证据且医学上可靠:

  • Well-Being 与 AI 专家委员会: 由青少年发展、心理健康和人机交互领域的专家组成的团队。该委员会基于最新研究定义福祉指标、设定优先级,并设计包括家长控制在内的安全措施。
  • 全球医生网络: 覆盖 60 个国家的 250 多名医生网络。其中超过 90 名医生(包括儿科医生和精神科医生)已参与心理健康情境下模型行为的研究,为安全研究和模型训练提供信息。

OpenAI 正在扩展该网络,纳入更多在青少年健康、物质使用和饮食失调方面具有专长的临床医生。

将推理模型集成用于危机检测

为提升敏感交互中的响应质量,OpenAI 将实现一个实时路由器,用于检测急性困扰的迹象。当检测到此类迹象时,系统会自动将对话路由至推理模型,例如 GPT-5-thinking,以提供更有益的回复,无论用户最初选择的模型为何。

为青少年提供的增强保护和家长控制

OpenAI 正在推出新工具,帮助家庭管理青少年(最低年龄 13 岁)使用 ChatGPT 的方式。在接下来的一个月内,将提供以下家长控制功能:

  • 账户关联: 家长可以通过电子邮件邀请将自己的账户与青少年的账户关联。
  • 行为规则: 家长可以管理适龄模型行为规则,默认已启用。
  • 功能管理: 家长可以禁用特定功能,例如聊天记录和记忆。
  • 困扰通知: 如果系统检测到青少年正处于急性困扰时刻,家长将收到通知,此功能在专家指导下开发,以维护家长与青少年之间的信任。

这些更新基于已有功能,例如应用内提醒,鼓励用户在长时间会话中适时休息。

Sources