Anthropic 因美國政府指令暫停 Fable 5 與 Mythos 5 服務
Anthropic 已根據美國政府的出口管制指令,對所有客戶停用 Fable 5 與 Mythos 5 的存取權。該指令於 2026 年 6 月 12 日發布,要求停用所有外籍人士的存取權,因此必須全面關閉這些特定模型以確保合規。
服務中斷範圍
全球所有使用者均無法存取 Fable 5 與 Mythos 5。其他 Anthropic 模型的存取權不受影響。
政府指令的依據
美國政府發布此指令,援引國家安全權限,但未提供有關具體擔憂性質的詳細資訊。Anthropic 報告稱,政府的行動基於其相信已發現可繞過或「越獄」Fable 5 的方法。
Anthropic 對政府所提供證據的內部審查結果如下:
- 政府提供的證據為口頭形式,且僅涉及一種狹窄、非普遍性的越獄方式。
- 該特定技術涉及要求模型讀取程式碼庫並修復軟體漏洞。
- 根據 Anthropic 的說法,此越獄所展示的能力,目前已廣泛存在於其他模型中,包括 OpenAI 的 GPT-5.5,且常被資安防禦者使用。
- 所識別的漏洞屬次要且早前已知。
Anthropic 的安全與防禦策略
Anthropic 強調,Fable 5 的部署採用「深度防禦」策略,承認目前任何模型供應商均無法實現完全的越獄防禦。此策略包含:
- 大量紅隊測試: 在上市前,與美國政府、英國 AISI、私人第三方組織及內部團隊進行數千小時的測試。
- 強力防護機制: 實施防護機制,以降低模型被濫用於資安任務的可能性,但部分使用者反映這些機制過於寬泛。
- 監控與資料保留: 保留客戶資料 30 天,以便公司能快速研究並應對越獄行為。
- 越獄分類: Anthropic 將「普遍性越獄」(廣泛繞過防護以解鎖廣泛的網路能力)與「非普遍性越獄」(僅在有限情境下誘導特定資訊)區分。公司表示,目前尚無測試者發現 Fable 5 的普遍性越獄。
對監管程序的立場
雖然遵守法律指令,Anthropic 仍不同意基於狹窄潛在越獄風險而召回商業模型的決定。公司認為,若將此標準應用於整個產業,將實際上阻礙所有前沿模型供應商的新模型部署。
Anthropic 主張,雖然政府應有權阻止不安全的部署,但此類行動應透過透明、公平、明確且基於技術事實的法定程序進行——而他們認為此特定行動並未遵循這些原則。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch