ChatGPT 锁定模式和提升风险标签
OpenAI 引入了锁定模式和“提升风险”标签系统,以保护用户免受提示注入攻击并防止未经授权的数据泄露。这些工具提供了深度防御的安全方法,使高风险用户和组织能够在牺牲部分产品功能的情况下获得更严格的防护措施。
锁定模式:面向高风险用户的确定性安全
锁定模式是一项可选的高级安全设置,面向具有更高安全需求的用户,如高管或安全团队,以降低基于提示注入的数据泄露风险。启用后,它通过确定性地禁用或限制特定工具和功能,严格约束 ChatGPT 与外部系统的交互方式。
锁定模式下的关键限制
为防止敏感数据在对话之外被共享,锁定模式限制或关闭以下功能:
- 实时网络访问: 浏览受限于缓存内容,确保没有实时网络请求离开 OpenAI 的受控网络。
- 图像支持: 响应中的图像支持已禁用。
- 深度研究: 包括购物研究功能。
- 代理模式和 Canvas 网络功能: 这些连接功能已禁用。
- 实时连接器和文件下载: 为降低提示注入类攻击的攻击面,这些功能已关闭。
可用性和管理
锁定模式最初在 ChatGPT Enterprise、Edu、Healthcare 和 Teachers 计划中推出。截至 2026 年 6 月 4 日,它已推广至个人 ChatGPT 账户和自助式 ChatGPT Business 账户。
对于组织管理员,锁定模式在现有管理员设置之上叠加额外限制。管理员可通过工作区设置创建新角色来启用它。为保持关键工作流,管理员仍可细粒度控制在锁定模式下哪些特定应用及其操作对用户保持可用。
提升风险标签:标准化风险沟通
OpenAI 正在标准化“提升风险”标签的使用,以在 ChatGPT、ChatGPT Atlas 和 Codex 中提供一致的指引。这些标签适用于引入网络相关风险且尚未被行业安全缓解措施完全覆盖的功能。
实施与目的
“提升风险”标签在用户启用可能带来额外安全风险的功能时(例如 Codex 中的网络访问用于查阅文档)进行提示。这使用户在处理私有数据时能够就是否使用这些功能做出明智选择。
OpenAI 表示,一旦安全技术取得足够进展以在一般使用中消除这些风险,这些标签将被移除,且带标签的功能列表将随时间进行更新。
深度防御策略
OpenAI 的安全方法侧重于在 AI 系统变得更强大且更互联时提供实用的防护。通过将锁定模式等确定性设置与透明的风险标签相结合,OpenAI 旨在降低新兴的提示注入风险,即第三方试图误导 AI 系统泄露敏感信息或执行恶意指令。