開源權重作為減緩前沿 AI 的開發機制
提案:透過開源權重來減緩 AI 進展
一封致 Anthropic CEO Dario Amodei 的公開信提案了一項立法強制要求:任何提供給公眾的 AI 模型都必須以開源權重的方式發布。 該提案的核心目標並非為了 AI 的民主化,而是透過消除驅動當前 AI 軍備競賽的財務激勵,從而有意識地減緩前沿模型的開發速度。
該論點認為,訓練前沿模型所需的大量資金取決於公司的估值,而這些估值是基於模型權重保持專有性質的假設。透過強制要求任何公開模型都必須開源權重,專有性的護城河將被摧毀,理論上這將減少投資者願意提供的資本量,從而同時減緩所有主要實驗室的進展速度。
對監管俘獲的批判
該提案認為,傳統的 AI 監管——例如嵌入第三方評估者、算力閾值以及與反壟斷豁免相關的產業協調——將不可避免地導致監管俘獲。因為前沿實驗室擁有最深厚的技術專業知識,他們是旨在監管他們的法律的主要設計者。
根據作者的說法,這會創造一個循環:
- 隨著新事件觸發新規則,監管變得越來越複雜。
- 大型公司可以負擔得起應對這些規則所需的法律和合規團隊。
- 新進者被有效地阻擋在市場之外,從而保護了現有實驗室的利潤和地位,而非減緩技術的開發。
社群分析與反論點
Hacker News 上技術觀察者的討論表明,該提案在經濟和安全假設方面存在根本性的缺陷。批評者的共識是,該計劃很可能導致比目前的專有模型更糟的結果。
經濟與戰略風險
批評者認為,該強制要求不會減緩進展,而是會轉移 AI 使用權的性質:
- 使用權的私有化: 如果公開發布要求開源權重,公司將簡單地停止提供公開模型,並完全轉向私有企業協議,從而加速前沿 AI 的私有化。
- 基礎設施主導地位: 開源權重並不會降低「小玩家」的進入門檻,因為運行 1T+ 參數模型所需的算力成本仍然高昂得令人望而卻步。這將使權力從模型開發者轉移到基礎設施層(雲端供應商)。
- 投資轉向: 有些人認為,如果投資者相信一個模型可以達到遞歸自我改進的「關鍵閾值」,那麼他們可能會忽略專有權重的損失,從而導致全球性的巨型企業出現,無論是否開源權重。
安全與安全疑慮
技術批評者指出,開源權重會顯著增加「消融」(abliteration,即移除安全護欄)的風險:
"If we open weights we can't detect it after being published / the guard rails that run on top of the models would be lost. Also abliteration would be much easier to do when a model's been publically release."
進一步的疑慮包括國家支持的行為者使用開源權重的前沿模型來發動網路攻擊或開發生物武器的風險,一旦權重公開,這些行為將無法被監控或撤銷。
不同觀點的總結
雖然公開信的作者將該提案視為對 Dario Amodei 是否致力於安全而非利潤的測試——引用 Anthropic 作為公益公司 (PBC) 的地位——但批評者認為該提議是天真的。這場辯論突顯了 AI 治理中的一個根本性緊張關係:主要風險究竟是權力集中在少數專有實驗室中,還是透過開源權重導致不對齊的、強大的能力擴散。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch