Anthropic 對於開放權重模型的立場:不主張禁止,重點在於晶片管制、蒸餾與安全性測試
Anthropic 對於開放權重模型的立場:不主張禁止,重點在於晶片管制、蒸餾與安全性測試
Anthropic 對於開放權重模型的立場
Anthropic 從未主張禁止開放權重模型。 該文章指出:「Anthropic 從未主張禁止開放權重模型。」它將不具備危險能力的開放權重模型描述為一種公共利益,能為企業、開發者和研究人員提供價值。
核心國家安全疑慮
Dario Amodei 指出了驅動其政策觀點的兩個噩夢情境。 首先,威權政府——不限於中國共產黨——可能會建立比美國開發的模型更強大的 AI 模型,並利用它們實現永久的軍事優勢或深度的國內壓迫。 其次,強大的 AI 模型可能會被誤用於網絡攻擊、生物攻擊,或遭遇嚴重的對齊問題,而開放權重模型由於護欄難以應用且釋出的權重無法撤回,因此構成了更高的風險。
建議的政策措施
Anthropic 支持三項具體的措施來應對這些疑慮。 第一,美國不應向中國銷售強大的晶片或晶片製造設備,並應打擊使人能夠獲得此類晶片的走私和規避行為,從而限制威權國家的 AI 訓練能力。 第二,美國應打擊大規模的蒸餾(distillation)操作,這類操作允許更具計算效率的模型構建,並部分規避了晶片禁令。 第三,所有具備足夠能力的模型——無論是開放還是封閉——在發布前都應接受針對網絡、生物和對齊風險的強制性安全性測試。
對業界公開信的回應
雖然同意公開信中關於開放權重益處的觀點,但 Anthropic 對於「它們天生有助於國防」的說法持有異議。 文章表示:「我同意其中的大部分內容:開放權重擴大了進入 AI 經濟的機會,它們至少在某些使用場景中加強了競爭,並讓客戶擁有更大的控制權。」然而,它補充道:「但我不同意該信中的斷言,即開放權重模型必然使開發防禦措施變得更容易,或者廣泛獲取能力必然比攻擊者對防禦者更有幫助。對我來說,相反的情況發生的可能性至少一樣大。」作者認為,關於風險與緩解的問題應該透過發布前的測試來進行實證回答,而不是進行假設。
社群反應與反論
Hacker News 的評論對 Anthropic 提議的可行性、動機和有效性表示懷疑。
「是的,這是 Anthropic 在主張禁止開放權重模型。誰來執行這項測試?如果測試成本太高,或者管理員拒絕讓某些人參與怎麼辦?這正是美國過去禁止商品的方式,透過要求一個印章然後拒絕核發它。」 — @cogman10
「基本上我們不應該禁止開放權重模型,但我們不應該讓它們變得跟前沿模型一樣好,因為中國很壞。而且我們別讓其他人能夠產出前沿模型。」 — @kelvinjps10(引用晶片與蒸餾部分)
「如果你真的相信禁令不起作用,同樣的情況也適用於硬體……巧合的是,所有這些舉措在商業上都有利於 Anthropic。如果 Dario 真的想表達觀點,如果 Anthropic 發布一個單獨的開放權重模型,效果會好得多。」 — @GodelNumbering
「如果一個模型測試失敗了怎麼辦?肯定有人會以某種方式將 Kimi K3 用於邪惡。現在該怎麼辦?『強制安全性測試』意味著失敗會有後果,但 Dario 對於後果應該是什麼卻隻字未提。」 — @modeless
「你可以給豬抹上口紅,它仍然是一頭豬……這些與主張開放權重模型是矛盾的。雖然不是直接矛盾,但足以讓人質疑第一個聲明。測試標準是什麼?如何通過?是由政府機構批准通過或失敗,還是全球性機構?如果是政府,而且看起來確實是,你如何區分大規模的企業遊說,以便設置安全性測試,讓藍衣警察(執法者)通過,而所有其他人則因安全疑慮被拒之門外?」 — @duplessitous
「所以論點基本上是:這項技術太危險了,所以只有『我們』應該擁有使用權。我們是好人,只有我們能確保這項技術的安全使用。誰來監督監督者(Quis custodiet ipsos custodes)?」 — @mjorgers
「致這裡所有推動開放模型全面擴散的人——對於開放權重的生物武器和網絡攻擊能力應該怎麼辦?難道我們應該允許攻擊者獲得這些工具,這就是自由的代價嗎?……你們真的想要這種程度的能力在沒有護欄的情況下普遍可用嗎?」 — @ajyoon
「『開放權重』模型並非開源。它們仍然具有高度的專有性。如果我們無法訪問它們的原始材料,如果不對它們進行審問,就不可能知道它們在做什麼或它們具備什麼能力。」 — @petcat
這些評論突顯了對執行力、潛在企業利益、測試結果缺乏透明度,以及認為這些提議儘管聲稱反對禁令,實際上可能限制開放性的看法。
相關 Anthropic 公告
抓取的內容還提到了其他最近的 Anthropic 更新:
- 與 Cognizant 擴大合作,將 Claude 帶給企業客戶。
- 推出 Claude Opus 5,被描述為 Opus 層級的階段性改進,為長期運行的代理(agents)提供動力,並在編碼和專業工作方面有所提升。
- 分享 Anthropic Economic Futures Research Fund 的研究議程。 這些項目作為獨立的新聞片段與立場聲明並列呈現。