OpenAI 隐私保护与《纽约时报》数据需求
OpenAI 正在法律上挑战来自《纽约时报》的要求,要求交出 2000 万条私密的 ChatGPT 对话。公司表示,此请求属于过度伸张,在未帮助解决双方正在进行的诉讼的情况下,威胁用户隐私。
用户对话的法律争议
OpenAI 正在抵制来自《纽约时报》的请求,以访问 2022 年 12 月至 2024 年 11 月期间随机抽取的 2000 万条 ChatGPT 对话。《纽约时报》声称这些数据是必要的,以便找出用户试图绕过其付费墙的示例。
OpenAI 将此需求描述为对隐私保护和安全实践的漠视。公司指出,《纽约时报》此前曾要求提供 14 亿条对话,并试图限制用户删除私聊的能力,而这两项要求均被 OpenAI 成功抵御。
受影响的用户和数据范围
此数据需求特别针对消费者 ChatGPT 对话的随机抽样。以下参数定义了影响范围:
- 时间范围: 发生在 2022 年 12 月至 2024 年 11 月之间的对话。
- 排除群组: ChatGPT Enterprise、ChatGPT Edu、ChatGPT Business(以前称为 "Team")以及 API 客户不受此需求影响。
- 选择方法: 该 2000 万条对象是从指定时间范围内随机抽取的。
隐私缓解措施和安全措施
为了在应对法律义务的同时保护用户信息,OpenAI 正在实施以下几项防护措施:
- 去标识化: OpenAI 正在对受影响的聊天运行一个程序,以清除个人身份信息(PII)、密码和其他敏感数据。
- 安全存储: 受法院命令约束的数据将存储在一个独立的安全系统中,处于法律保持状态,仅限少数经过审计的法律和安全团队访问。
- 访问控制: OpenAI 正在推动仅让《纽约时报》的外部顾问和技术顾问在严格的法律协议下的安全环境中查看这些数据。
OpenAI 之前曾向《纽约时报》提供隐私保护的替代方案,例如针对《纽约时报》文章文本的定向搜索或对 ChatGPT 使用情况的高级数据分类,但这些方案被拒绝。
未来隐私路线图
为应对这些隐私挑战,OpenAI 正在加速其安全路线图,以防止未经授权的数据访问。主要计划功能包括:
- 客户端加密: 这将确保与 ChatGPT 的消息保持私密,任何人(包括 OpenAI)都无法访问。
- 自动安全检测: 公司正在构建完全自动化的系统来检测安全问题。人工审查将仅限于一个小型、经过审查的团队,并且仅保留用于关键风险,例如网络安全威胁或对生命的威胁。
OpenAI 首席信息安全官 Dane Stuckey 强调,随着 AI 越来越融入个人生活,隐私保护必须变得更强大,以维持用户信任。