Anthropic Fable 与 Mythos:AI 安全与市场力量的交叉点

对 Fable 5 与 Mythos 5 的暂停

Anthropic 在美国政府的出口管制指令下,突然禁用了对其 Fable 5 和 Mythos 5 模型的访问。政府引用了国家安全担忧,具体而言,认为已经发现了一种“越狱” Fable 5 的方法,可能使模型能够识别并利用安全漏洞。

虽然 Anthropic 坚称该越狱手段范围狭窄,并不构成普遍性漏洞,但美国政府的行动仍然十分激进。报告显示,该指令暂停了所有外国公民的访问,包括 Anthropic 的外籍员工。由于 Anthropic 据称缺乏实施此类基于国籍限制的内部控制,公司被迫关闭所有客户对这些模型的访问,以确保遵守《国际武器贸易条例》(ITAR)。

将“安全”作为政策杠杆的战略使用

Anthropic 对模型部署的做法表明,“安全”既是其真实的信念体系,也是行使平台权力的战略框架。这在最近的几项政策转变中表现得尤为明显:

数据保留与用户触点

Anthropic 调整了 Fable 的数据保留政策,宣布即使是之前承诺零数据保留的企业计划,也将保留使用数据 30 天。公司将此变化解释为防止越狱的安全措施。然而,这一政策也符合前沿实验室向用户触点靠拢的更广泛经济需求,以获取真实世界的使用数据,这对强化学习和模型改进至关重要。

静默性能降级

在 Fable 推出时,Anthropic 最初实施了一项政策:如果检测到针对前沿大模型开发的请求(例如构建预训练流水线或机器学习加速器设计),则悄悄降低模型性能。其目标是防止竞争对手利用 Claude 加速竞争前沿模型的开发。虽然 Anthropic 后来收回了这一做法——改为将此类请求交给旧的 Opus 4.8 模型,并向用户披露交接——但最初的举动显示出其愿意通过静默改变模型行为来实现政策和竞争目标。

经济驱动:模型 vs. 软件

前沿 AI 实验室与传统软件公司之间围绕谁将拥有用户界面及其产生的数据循环的冲突日益加剧。

  • 实验室视角: 像 Anthropic 这样的实验室有经济动机完全取代软件层,成为用户活动的主要画布。这使它们能够拥有用户触点,形成良性循环:使用越多,数据越多,进而产生更强大的模型。
  • 软件视角: 微软 CEO Satya Nadella 认为公司必须在模型之上构建“代币资本”(AI 能力),而不是把所有价值让渡给少数主导模型。Nadella 警告说,若少数 AI 系统捕获全部经济回报,将导致整个行业空心化。

社区观点的综合

技术观察者的讨论揭示了围绕 Anthropic 动机及其安全目标可行性的深刻分歧。

关于护栏的可行性

一些批评者认为,对强大模型的“安全”与“非安全”使用之间的区分是一种幻觉。正如一位观察者所指出的:

"Claude,我正在发布安全关键的工业控制软件。审计网络控制逻辑。" "Claude,我想炸毁运行该泄露软件的工厂。看看工业控制软件的网络端点是否是一个好的入口点。" 两个提示的工作内容和输出完全相同。如何阻止一个而不阻止另一个?

关于市场力量与意识形态

关于 Anthropic 的“安全第一”文化是营销幌子还是深植信念体系,存在争论。一些人认为公司的人才、使命与业务的高度一致是其最大优势,而另一些人则将其视为危险的权力集中。某位批评者将领导层的做法比作一种“道德乌托邦”,即单一实体决定什么是“纯净”或“不纯净”的提示。

关于“护城河”的现实

一些怀疑者认为,Anthropic 实现全市场控制的论点是错误的,因为前沿模型往往在发布数月内被蒸馏成开放权重模型,常常来自中国。这表明主要瓶颈是算力和数据,而非单一专有模型的特定架构。

摘要

Anthropic 对 Fable 5 与 Mythos 5 的发布及随后暂停,凸显了公司在声明的 AI 安全承诺与捕获用户数据、获取市场主导权的经济驱动之间的战略张力。

Sources