Anthropic Claude 故障 Sep 3 2026:多個模型出現高錯誤率

事件概覽

Anthropic 於 2026 年 9 月 3 日報告了一次多模型故障,導致 Claude Mythos 5.1、Claude Fable 5.1、Opus 5、Opus 4.8 和 Opus 4.6 的錯誤率上升。此次故障影響了網頁 UI (claude.ai)、公開 API (api.anthropic.com)、Claude Code 和 Claude Cowork,促使開發者不得不退回到舊版模型或使用其他供應商。


狀態更新時間線

  • 13:26 UTC – 開始調查 – Anthropic 宣布他們正在調查 Mythos 5.1、Fable 5.1 和 Opus 5 的高錯誤率問題。
  • 13:41 UTC – 確認原因 – 團隊表示他們已識別出這三個模型的高錯誤率原因,並正在努力修復。
  • 13:50 UTC – 發布完整列表 – 發布了受影響模型的完整列表:Mythos/Fable 5.1、Mythos/Fable 5、Opus 5、Opus 4.8、Opus 4.6。
  • 14:49 UTC – 持續修復中 – Anthropic 發文表示他們正在持續進行修復工作。
  • 15:25 UTC – 部分恢復 – Opus 4.8 和 Opus 5 仍受影響;所有其他模型已恢復至基準錯誤率。

受影響的模型與服務範圍

Model Status as of 15:25 UTC Services impacted
Claude Mythos 5.1 Recovered (not listed in final update) Claude.ai, API, Code, Cowork
Claude Fable 5.1 Recovered Claude.ai, API, Code, Cowork
Opus 5 Still elevated errors Claude.ai, API, Code, Cowork
Opus 4.8 Still elevated errors Claude.ai, API, Code, Cowork
Opus 4.6 Recovered Claude.ai, API, Code, Cowork

此次故障僅限於 Anthropic 的基礎設施;依賴 Claude 的第三方服務(例如 GitHub Copilot、X.ai 的 Grok)也報告了類似的性能下降,這表明存在共同的上游故障。


社群群眾影響與應對措施

  • 開發者切換至舊版模型 – 用戶報告退回到 Claude Sonnet 或其他供應商(例如 OpenAI Codex)以繼續進行編碼任務。
  • Claude Code 自動模式失效 – 正如一位評論者所提到的,Claude Code 的預設 auto 安全模式依賴於 Sonnet 模型。由於 Sonnet 無法使用,自動模式無法判斷安全性,導致出現如下錯誤:

    "Error: claude-sonnet-5 is temporarily unavailable (overloaded), so auto mode cannot determine the safety of Edit right now."

  • 跨供應商故障 – 多位評論者觀察到 OpenAI 的 Codex 和 X.ai 的 Grok 同時發生故障,暗示這可能是一次更廣泛的雲端供應商事件。

"Both claude and codex down at the same time! Might actually get some quality code merged in today, for a change!" – Hacker News user

"Not just claude, even grok seems to be down – https://://status.x.ai/" – Hacker News user


推測的根本原因

狀態頁面並未披露技術細節,僅提到「已識別出原因」。社群推測包括:

  • Cloudflare 或上游網路問題 – 一位評論者提供了 Cloudflare 的狀態頁面連結,指出近期多家 AI 實驗室都出現了錯誤。
  • Datacenter 過載 – 幾位用戶指出「SpaceX 的數據中心存在問題」,暗示存在共同的基礎設施供應商。
  • 模型特定的安全分類器失效 – Claude Code 的自動模式錯誤顯示 Sonnet 的安全分類器過載,這可能連帶影響到其他模型。

官方並未對這些假設提供任何正式確認。


給開發者的建議

  1. 設計具備優雅降級的能力 – 依賴單一安全分類器 (Sonnet) 會導致 Claude Code 在該模型失效時變得無法使用。實施 fallback 分類器或暫時禁用安全檢查,可以讓核心功能保持運作。

  2. 監控多個供應商 – Anthropic、OpenAI 和 X.ai 的同時故障,強調了對於關鍵工作流程而言,多供應商冗餘的多重價值。

  3. 保持關注供應商供應商狀態頁面 – Anthropic 狀態網站的即時更新對於了解哪些模型仍可使用是至關重要的。


展望

Anthropic 的快速識別與逐步恢復,顯示出其成熟的事件應對程序,但每週錯誤率上升的頻率(如部分用戶所報告)顯示出系統性的可靠性挑戰。開發者應持續監控狀態更新,並考慮使用退回機制,直到根本原因(無論是網路層級、數據中心層級或模型特定的)得到完全解決。

Sources

相關