Anthropic 根据美国政府指令暂停 Fable 5 和 Mythos 5 的使用

Anthropic 在收到美国政府出口管制指令后,已为所有客户禁用了 Fable 5 和 Mythos 5 的访问权限。该指令于 2026 年 6 月 12 日发布,要求暂停所有外国公民的访问权限,这使得必须完全关闭这些特定模型以确保合规性。

服务中断范围

Fable 5 和 Mythos 5 对全球所有用户的访问均已暂停。对 Anthropic 所有其他模型的访问不受影响。

政府指令的依据

美国政府引用国家安全权限发布了该指令,但并未提供有关担忧的具体性质的详细信息。Anthropic 报告称,政府的行为是基于一种认为已发现绕过或“越狱” Fable 5 的方法的观点。

Anthropic 对政府证据的内部审查表明了以下情况:

  • 提供的是口头证据,且涉及的是一种狭窄的、非通用的越狱方式。
  • 该特定技术涉及要求模型阅读代码库并修复软件缺陷。
  • 根据 Anthropic 的说法,这种越狱所展示的能力在其他模型中(包括 OpenAI 的 GPT-5.5)已经广泛可用,并且常被网络安全防御人员使用。
  • 所识别出的漏洞是轻微的且此前已知的。

Anthropic 的安全与防御策略

Anthropic 坚持认为 Fable 5 是采用“深度防御”策略部署的,并承认目前对于任何模型提供商来说,完美的越狱抵抗力都是不可能的。该策略包括:

  • 广泛的红队测试: 在发布前与美国政府、英国 AISI、私人第三方组织以及内部团队进行了数千小时的测试。
  • 强力保障措施: 实施了旨在降低在网络安全任务中被滥用的可能性的保障措施,一些用户报告称这些措施过于宽泛。
  • 监控与数据保留: 实行 30 天客户数据保留政策,以便公司能够快速研究并缓解越狱问题。
  • 越狱分类: Anthropic 区分了“通用越狱”(广泛绕过保障措施以解锁广泛的网络能力)和“非通用越狱”(在有限的情况下诱导特定信息)。公司表示,目前尚未有测试人员发现 Fable 5 的通用越狱方式。

对监管流程的立场

在遵守法律指令的同时,Anthropic 不同意基于一种狭窄的潜在越狱方式而召回商业模型的决定。公司认为,如果将这一标准应用于整个行业,将实际上停止所有前沿模型提供商的新模型部署。

Anthropic 断言,政府应当拥有阻止不安全部署的权力,但此类行动应当通过透明、公平、清晰且基于技术事实的法定程序进行——他们声称这次特定的行动并未遵循这些原则。

Sources

相关