Anthropic 对开源权重模型的立场
Anthropic 已明确表示,它并不主张禁止开源权重模型。首席执行官 Dario Amodei 断言,不具备危险能力的开源权重模型通过为研究人员、开发者和企业提供价值(除了必要的计算成本外无需额外费用),起到了公共利益的作用。
国家安全担忧与禁令的局限性
Anthropic 识别出两个主要的国家安全风险,而针对开源权重模型的保护主义禁令无法解决这些风险:
1. 威权主义军事与监控优势
主要的担忧是,威权政府——特别是中国共产党 (CCP)——可能会开发出比美国更强大的 AI 模型,以实现永久性的军事优势或实施深度的内部镇压。Amodei 指出,最危险的模型很可能是那些秘密训练并专门用于国家安全和军事用途(例如无人机)的模型,这使得开源权重状态或美国企业使用这些模型与这一特定威胁无关。
2. 网络与生物攻击的滥用
次要的担忧涉及强大的 AI 模型被滥用于网络攻击、生物攻击或遭受严重的对齐问题。虽然开源权重模型可能比闭源模型呈现更高的风险,因为护栏(guardrails)更难实施且权重一旦发布就无法撤回,但禁止美国企业使用这些模型并不能减轻这一风险,因为坏人不太可能是合法的美国企业。
为 AI 安全与安全提出的政策措施
Anthropic 并不主张对开源权重模型进行全面禁令,而是提倡三种具体的战略措施:
限制硬件访问
Anthropic 支持禁止向中国销售强大的芯片和芯片制造设备,并打击走私和规避手段。由于缩放法则 (scaling laws),如果没有这些芯片,中国无法构建比美国更强大的模型,这使得该措施成为阻断威权主义 AI 开发优势的最直接方式。
威慑工业规模的蒸馏
Anthropic 呼吁通过政策干预来威慑工业规模的蒸馏操作。蒸馏允许威权国家构建出比其可用硬件通常允许的更好的模型,这可能使中国的尖端水平在几个月内接近美国的尖端水平。Amodei 澄清说,虽然一些进行蒸馏的公司会发布开源权重模型,但核心问题在于国家支持的赶超美国尖端水平的努力,而不是权重的开源性质。
对具备能力的模型进行强制性安全测试
Anthropic 提议,所有具备足够能力的模型,无论其是开源还是闭源权重,也无论其来源国是哪国,在发布前都必须接受针对生物、网络和对齐风险的强制性安全测试。Amodei 建议,在预防 AI 驱动的生物武器方面,可能可以实现有限的全球合作,包括与中国进行合作,因为避免此类结果符合中国自身的利益。
对开源权重辩论的观点
针对一封支持开源权重模型的公开信,Amodei 同意开源权重扩大了经济准入并加强了竞争。然而,他反驳了“开源权重模型必然使开发防护措施变得更容易”或“它们对防御者的益处多于对攻击者的益处”这一说法。
Amodei 强调了生物领域中一个特定的“攻击者-防御者不对称性”,即一个具备能力的模型可以快速将病毒武器化,而防御(如疫苗开发)则是一项为期数年的运营任务。他认为,这些风险应该通过发布前的经验性测试来确定,而不是预先假设。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch