OpenAI Model Spec 更新:未满18岁(U18)原则

OpenAI 已更新其 Model Spec——即指导 AI 模型行为的规则和行为期望的集合——以纳入未满18岁(U18)原则。这些原则通过优先考虑预防、透明度以及基于发展科学的早期干预,确保 ChatGPT 为13至17岁用户提供安全且适龄的体验。

U18 原则的核心承诺

U18 原则阐明了 Model Spec 在青少年情境中的应用方式,在这些情境中,对未成年人的安全考虑更为突出。该框架由四项指导性承诺支撑:

  • 优先考虑青少年安全: 安全被置于首位,即使这与其他模型目标冲突。
  • 促进现实世界支持: 模型旨在鼓励线下关系以及使用可信资源。
  • 适龄互动: 模型将青少年视为青少年,既避免居高临下,也不对他们成年人般对待。
  • 透明度: 系统为用户设定明确的期望。

安全防护和高风险领域

与青少年安全蓝图保持一致,OpenAI 已实施防护措施,以确保模型在讨论高风险话题时格外谨慎。这些防护措施适用于在注册时自认为未满18岁的用户,并通过家长控制进行管理。

特定高风险领域包括:

  • 自残和自杀
  • 浪漫或带有性暗示的角色扮演
  • 图形化或露骨内容
  • 危险活动和物质
  • 身体形象和饮食失调
  • 要求保密不安全行为的请求

当出现安全问题时,青少年会遇到更严格的防护措施、更安全的替代方案,并被鼓励寻求线下支持。在存在迫在眉睫风险的情况下,模型会敦促用户联系紧急服务或危机资源。

专家合作与临床指导

OpenAI 通过与外部专家(包括美国心理学会 APA)预览这些原则来制定它们。APA 首席执行官 Arthur C. Evans Jr 博士强调,AI 工具应当与对社会和心理发展至关重要的人际互动相平衡:

"APA 鼓励 AI 开发者为其产品的青少年用户提供符合发展阶段的预防措施,并对更年轻的用户采取更具保护性的方法。如果 AI 工具能够与科学表明对社会、心理、行为乃至生物发展至关重要的人际互动相平衡,儿童和青少年可能会从中受益。"

此外,福祉与 AI 专家委员会提供指导,就各年龄段的健康 AI 互动提供建议;全球医生网络则帮助模型更好地识别痛苦并引导用户寻求专业护理。

产品集成与未来路线图

青少年防护已扩展到多种产品,包括群聊、ChatGPT Atlas 浏览器以及 Sora 应用。为了进一步实现这些防护的自动化,OpenAI 正在 ChatGPT 消费者计划中推出年龄预测模型。当系统认为账户属于未成年人时,该模型将自动应用青少年防护措施;如果无法可靠验证年龄,系统将默认使用 U18 体验。

这些安全措施建立在 GPT-5.2 奠定的基础之上,并包括与 ThroughLine 的合作,以在 ChatGPT 和 Sora 中呈现本地化的求助热线。

Sources