Anthropic 對於開放權重模型的立場

Anthropic 已明確表示,它並不主張禁止開放權重模型。執行長 Dario Amodei 指出,不具備危險能力的開放權重模型能為研究人員、開發人員和企業提供價值,且除了必要的運算成本外無需額外支出,因此能作為一種公共利益。

國家安全疑慮與禁令的局限性

Anthropic 指出,保護主義式的開放權重模型禁令無法解決兩大主要的國家安全風險:

1. 威權主義軍事與監控優勢

主要的擔憂在於威權政府——特別是中國共產黨 (CCP)——可能會開發出比美國更強大的 AI 模型,以實現永久性的軍事優勢或實施深度的內部鎮壓。Amodei 指出,最危險的模型很可能是那些秘密訓練並保留給國家安全和軍事用途(例如無人機)的模型,這使得開放權重狀態或美國企業使用這些模型的行為,對於應對這類特定威脅而言是無關緊要的。

2. 網路攻擊與生物攻擊的誤用

次要的擔憂涉及強大的 AI 模型被誤用於網路攻擊、生物攻擊,或面臨嚴重的對齊問題的風險。雖然開放權重模型可能比封閉模型呈現更高的風險,因為護欄 (guardrails) 更難以施加,且權重一旦發布便無法撤回,但禁止美國企業使用這些模型並不能減輕這種風險,因為惡意行為者不太可能是合法的美國企業。

建議的 AI 安全與安全政策措施

Anthropic 並非主張對開放權重模型進行全面禁令,而是提倡三項特定的戰略措施:

限制硬體存取權

Anthropic 支持禁止向中國銷售強大的晶片和晶片製造設備,並打擊走私和規避手段。由於規模定律 (scaling laws),如果沒有這些晶片的存取權,中國無法建立比美國更強大的模型,這使得這成為阻擋開發優越的威權主義 AI 最直接的方式。

遏制工業規模的蒸餾 (Distillation)

Anthropic 呼籲透過政策干預來遏制工業規模的蒸餾作業。蒸餾技術允許威權國家建立比其可用硬體通常所能允許的更強大的模型,這可能使中國的前沿技術水平在幾個月內接近美國的前沿技術水平。Amodei 澄清,雖然有些進行蒸餾的公司會發布開放權重模型,但核心問題在於國家支持的試圖超越美國前沿技術的努力,而非權重的開放性質。

強制性能力模型安全測試

Anthropic 建議,所有具備足夠能力的模型,無論其權重是開放還是封閉,也無論其來源國為何,在發布前都應接受針對生物、網路和對齊風險的強制性安全測試。Amodei 建議,在防止 AI 驅動的生物武器方面,可能可以與中國進行有限的全球合作,因為避免這種結果符合中國自身的利益。

對於開放權重辯論的觀點

針對一封支持開放權重模型的公開信,Amodei 同意開放權重能擴大經濟准入並加強競爭。然而,他反駁了「開放權重模型必然使開發防禦措施變得更容易」或「它們對防禦者的益處多於對攻擊者的益處」的說法。

Amodei 強調了生物領域中特定的「攻擊者與防禦者不對稱性」 (attacker-defender asymmetry),在該領域中,一個具備能力的模型可以迅速將病毒武器化,而防禦(例如疫苗開發)則是一項為期多年的營運任務。他認為,這些風險應透過發布前的實證測試來判定,而非預先假設。

Sources

相關