Anthropic 增加對 Public First Action 的支持至 4000 萬美元
Anthropic 已向 Public First Action 追加捐贈 2000 萬美元,使其總財務支持達到 4000 萬美元。這筆資金專門用於公共教育和政策使命,旨在建立合理的 AI 安全防護措施,且不得用於影響聯邦、州或地方選舉。
加速 AI 能力與相關風險
AI 模型能力的快速提升正在產生迫切的安全漏洞,需要政府立即採取行動。Anthropic 引用了 Claude Mythos Preview 的例子,該模型在每個主要作業系統和瀏覽器中發現了數千個高嚴重性的軟體漏洞。為了降低這些漏洞被利用的風險,Anthropic 透過 Project Glasswing 向有限數量的網路防禦者發布了該模型。
雖然先進模型提供了巨大的潛在利益——包括加速藥物研發、疾病治療、科學進步、延長人類壽命以及經濟增長——但 Anthropic 主張,必須先建立防範災難性風險的保護措施,才能實現這些收益。該公司強調,政府需要立即爭取時間來建立管理這些風險的能力,同時獲取其益處。
前沿 AI 的擬定政策框架
Anthropic 主張,鑑於 AI 進步的速度,單靠透明度是不夠的。該公司倡導採取全面的風險緩解方法,如 Advanced AI Framework 中所詳述,其中包括以下要求:
- 驗證與執行: 政府應具備驗證安全聲明、透過民事處罰強制執行安全實踐,以及阻止部署可能造成嚴重災難性傷害風險的模型的能力。
- 測試與評估: 前沿 AI 開發者必須針對災難性風險測試模型、對研究結果保持透明、將模型提交給獨立評估,並運行穩健的安全計畫。
國家安全與全球 AI 領導地位
為了維持美國及其民主盟友的領導地位,Anthropic 支持特定的國家安全措施,以防止先進技術惠及威權政權。這些擬定的措施包括:
- 出口管制: 加強對先進晶片和半導體製造設備的管制。
- 存取限制: 遏制非法模型存取並防止蒸餾攻擊。
Anthropic 將這些政策框架視為起點,並利用其對 Public First Action 的支持,來提高圍繞 AI 安全與國家安全之迫切政策辯論的關注度。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch