OpenAI 知识自由设计框架

OpenAI 正在为 ChatGPT 实施一种以知识自由为优先的设计理念,确保用户能够探索多元视角并遵循自己的推理,而不被引导至特定的世界观。此方法将默认的客观性与细粒度的用户控制以及透明的行为准则相结合。

默认客观性与模型规范

ChatGPT 的设计默认保持客观,尤其是在涉及竞争的政治、文化或意识形态观点的话题时。系统并非提供唯一的确定答案,而是帮助用户探索多种视角。

为确保透明度,OpenAI 通过模型规范公开了内部指导方针。该文档概述了系统中整合的核心价值观,具体包括:

  • 有用性:确保模型提供有帮助的回应。
  • 安全性:防止生成有害内容。
  • 中立性:在敏感话题上保持公正立场。
  • 知识自由:允许用户在不受意识形态引导的情况下探索想法。

知识自由的原则

ChatGPT 中的知识自由被定义为用户能够探索想法——包括有争议或困难的——而模型不会将其推向特定的世界观。

OpenAI 将知识自由与缺乏约束区分开来。模型仍然经过训练以避免:

  • 造成伤害。
  • 侵犯隐私。
  • 协助危险活动。

此外,模型的设计旨在协作而非回音室;它被指示不要仅仅验证每个用户的陈述或重复用户的观点,而是保持开放、深思和响应,而不显得说教。

用户可控的自定义

虽然客观性是基线,OpenAI 提供了自定义设置,使用户能够将 AI 的沟通风格适配到其特定情境。这些控制项调整事实的表达方式,而不改变事实本身。

可用的个性化选项包括调整:

  • 语气:定制回应的情感或专业程度。
  • 指令:设定模型行为的具体指南。
  • 回应风格:定义输出的语调(例如,教师需要清晰来源,护理者需要共情)。

偏见评估与持续改进

OpenAI 正在超越传统基于评分标准的测试,以更好地衡量现实场景中的政治偏见和客观性。由于标准的多项选择测试并未反映用户实际与 AI 的交互方式,OpenAI 正在开发基于日常使用模式的新评估——具体而言,关注人们提问和探索想法的方式。

此改进过程包括:

  • 公民社会参与:与不同政治光谱的用户和组织开展反馈会议,以识别性能差距。
  • 真实场景评估:开发基于实际用户对话流程而非理论测试的偏见识别评估。
  • 生态系统共享:OpenAI 打算分享其偏见评估方法,以帮助 AI 生态系统中面临类似挑战的其他组织。

Sources