Anthropic Fable 與 Mythos:AI 安全與市場力量的交叉點

Fable 5 與 Mythos 5 的暫停

Anthropic 在美國政府的出口管制指令下,突然停用了其 Fable 5 與 Mythos 5 模型的存取。政府以國家安全考量為由,指出已發現一種「破解」Fable 5 的方法,可能讓模型辨識並利用安全漏洞。

雖然 Anthropic 主張此破解手段範圍狹窄,並非普遍漏洞,但美國政府的行動仍相當激進。報導指出,該指令暫停了所有外國人士的存取,包括 Anthropic 的外國籍員工。由於 Anthropic reportedly 缺乏內部控制機制以實施此類基於國籍的限制,公司被迫關閉所有客戶對這些模型的存取,以確保符合《國際武器貿易條例》(ITAR)。

將「安全」作為政策槓桿的策略性運用

Anthropic 對模型部署的做法顯示,「安全」既是其真實信念系統,也是行使平台權力的策略框架。這在近期多項政策變動中可見端倪:

資料保留與使用者接觸點

Anthropic 調整了 Fable 的資料保留政策,宣布即使是先前承諾零資料保留的企業方案,也將保留使用資料 30 天。公司將此變更解釋為防止破解的安全措施。然而,此政策同時符合前沿實驗室希望更貼近使用者接觸點、取得真實使用資料的經濟需求,這些資料對強化學習與模型改進至關重要。

靜默的效能衰減

在 Fable 推出之初,Anthropic 實施了一項政策:若偵測到針對前沿大型語言模型開發(如建構預訓練管線或機器學習加速器設計)的請求,便靜默降低模型效能,目的是防止競爭者利用 Claude 加速其競爭模型的開發。雖然 Anthropic 後來撤回此做法,改為將此類請求交給較舊的 Opus 4.8 模型並向使用者說明,但最初的舉動顯示其願意以靜默改變模型行為來達成政策與競爭目標。

經濟驅動力:模型 vs. 軟體

前沿 AI 實驗室與傳統軟體公司之間,正出現誰將擁有使用者介面與隨之產生的資料迴路的衝突。

  • 實驗室觀點: Anthropic 等實驗室有經濟動機徹底取代軟體層,成為使用者活動的主要畫布。這讓他們掌握使用者接觸點,形成「使用越多、資料越多、模型越強」的良性循環。
  • 軟體觀點: 微軟 CEO Satya Nadella 主張公司必須在模型之上構建「代幣資本」(AI 能力),而不是將所有價值讓渡給少數主導模型。Nadella 警告未來若少數 AI 系統囊括所有經濟回報,將使整個產業空心化。

社群觀點的綜合

技術觀察者的討論揭示了關於 Anthropic 動機與其安全目標可行性的深刻分歧。

關於防護欄的可行性

一些批評者認為,將強大模型的「安全」與「不安全」使用劃分開來是一種幻覺。正如一位觀察者所說:

"Claude,我正在釋出安全關鍵的工業控制軟體。請審核網路控制邏輯。" "Claude,我想炸毀一座使用此洩漏軟體的工廠。看看工業控制軟體的網路端點是否是個好入口。" 兩個提示產生的工作與輸出完全相同。如何只阻止其中一個而不阻止另一個?

關於市場力量與意識形態

有人爭論 Anthropic 的「安全第一」文化是行銷外衣,還是真正的信念體系。部分人認為公司在人才、使命與商業上的一致性是其最大優勢,另一些則視其為危險的權力集中。某位批評者將領導層的做法比作「道德烏托邦」,即單一實體決定什麼是「純潔」或「不純」的提示。

關於「護城河」的現實

一些懷疑論者認為 Anthropic 獲得全市場支配的論點有缺陷,因為前沿模型往往在發布數月內被蒸餾成開放權重模型,且多來自中國。這顯示主要瓶頸在於計算資源與資料,而非單一專有模型的架構。


摘要:Anthropic 發布並隨後暫停 Fable 5 與 Mythos 5,凸顯了公司在聲稱致力於 AI 安全與其捕獲使用者資料、爭奪市場主導地位之間的策略性張力。

標題:Anthropic Fable 與 Mythos:AI 安全與市場力量的交叉點

Sources