Anthropic Claude 故障 Sep 3 2026:多个模型出现高错误率

事件概览

Anthropic 报告在 2026 年 9 月 3 日发生了多模型故障,导致 Claude Mythos 5.1、Claude Fable 5.1、Opus 5、Opus 4.8 和 Opus 4.6 的错误率上升。此次故障影响了 Web UI (claude.ai)、公共 API (api.anthropic.com)、Claude Code 和 Claude Cowork,促使开发者转向使用旧版模型或替代供应商。


状态更新时间线

  • 13:26 UTC – 开始调查 – Anthropic 宣布他们正在调查 Mythos 5.1、Fable 5.1 和 Opus 5 的高错误率问题。
  • 13:41 UTC – 确定原因 – 团队表示他们已经确定了这三个模型高错误率的原因,并正在努力修复。
  • 13:50 UTC – 发布完整列表 – 发布了受影响模型的详尽列表:Mythos/Fable 5.1、Mythos/Fable 5、Opus 5、Opus 4.8、Opus 4.6。
  • 14:49 UTC – 持续修复中 – Anthropic 发布消息称他们正在继续进行修复工作。
  • 15:25 UTC – 部分恢复 – Opus 4.8 和 Opus 5 仍受影响;所有其他模型已恢复到基准错误率。

受影响的模型与服务范围

Model Status as of 15:25 UTC Services impacted
Claude Mythos 5.1 Recovered (not listed in final update) Claude.ai, API, Code, Cowork
Claude Fable 5.1 Recovered Claude.ai, API, Code, Cowork
Opus 5 Still elevated errors Claude.ai, API, Code, Cowork
Opus 4.8 Still elevated errors Claude.ai, API, Code, Cowork
Opus 4.6 Recovered Claude.ai, API, Code, Cowork

此次故障仅限于 Anthropic 自身的架构;依赖 Claude 的第三方服务(例如 GitHub Copilot、X.ai 的 Grok)也报告了类似的性能下降,这表明存在共同的上游故障。


社区-影响与应对措施

  • 开发者转向使用旧版模型 – 用户报告称,他们回退到了 Claude Sonnet 或其他供应商(例如 OpenAI Codex)以继续进行编码任务。
  • Claude Code 自动模式失效 – 正如一位评论者所言,Claude Code 的默认 auto 安全模式依赖于 Sonnet 模型。由于 Sonnet 不可用,自动模式无法确定安全性,从而导致了如下错误:

    "Error: claude-sonnet-5 is temporarily unavailable (overloaded), so auto mode cannot determine the safety of Edit right now."

  • 跨供应商故障 – 多位评论者观察到 OpenAI 的 Codex 和 X.ai 的 Grok 同时出现故障,暗示这可能是一次更广泛的云服务商故障。

"Both claude and codex down at the same time! Might actually get some quality code merged in today, for a change!" – Hacker News user

"Not just claude, even grok seems to be down – https://://status.x.ai/" – Hacker News user


推测的根本原因

状态页面并未披露除“已确定原因”之外的技术细节。社区推测包括:

  • Cloudflare 或上游网络问题 – 一位评论者提供了 Cloudflare 的状态页面链接,指出近期多个 AI 实验室都出现了错误。
  • 数据中心过载 – 几位用户指出“SpaceX 数据中心出现问题”,暗示存在共同的基础设施供应商。
  • 模型特定的安全分类器失效 – Claude Code 自动模式的错误表明 Sonnet 的安全分类器过载,这可能引发了连锁反应,影响到其他模型。

官方并未对这些假设进行确认。


开发者建议

  1. 设计具备优雅降级能力的系统 – 依赖单一的安全分类器(Sonnet)会导致 Claude Code 在该模型失效时变得无法使用。实现回退分类器或临时禁用安全检查可以保持核心功能的使用。

  2. 监控多个供应商 – Anthropic, OpenAI, 和 X.ai 同时出现故障,这突显了显现了多供应商冗余对于关键工作流的重要性。

  3. 关注供应商的状态页面 – 来自 Anthropic 状态页面的实时更新对于了解哪些模型仍可使用至关重要。


展望

Anthropic 的快速识别和逐步恢复过程表明其具备成熟的事故-响应过程,但(如部分用户报告的)每周错误率上升的情况表明其系统性可靠性挑战仍然存在。开发者应持续关注未来的状态更新,并考虑采用回退策略,直到根本原因(无论是网络层、数据中心层还是模型特定层)得到完全解决。

Sources

相关