Anthropic 为加州 SB 53 法案发布的前沿合规框架
Anthropic 已发布其前沿合规框架 (FCF),以遵守将于 1 月 1 日生效的加州《前沿 AI 透明度法案》(SB 53)。该框架为公司如何评估和管理与前沿 AI 模型相关的灾难性风险建立了一个公开标准。
前沿合规框架 (FCF) 概述
前沿合规框架 (FCF) 是 Anthropic 用于满足 SB 53 法律要求的核心文件。它详细说明了公司评估和缓解特定高风险风险的过程,包括:
- 灾难性威胁: FCF 涵盖了网络攻击、化学、生物、放射性及核 (CBRN) 威胁,以及与 AI 破坏和失去控制相关的风险。
- 能力评估: 该框架利用分层系统,针对这些风险类别评估模型能力。
- 运营安全: FCF 概述了保护模型权重并应对安全事件的方法。
FCF 与负责任扩展政策 (RSP) 的关系
虽然 FCF 是满足 SB 53 及其他监管要求的强制性合规文件,但它与 Anthropic 的负责任扩展政策 (RSP) 不同。RSP 仍是一项自愿性安全政策,反映了公司的内部最佳实践,并随着 AI 领域的变革而演进,其标准可能超过当前的监管指令。
倡导联邦 AI 透明度标准
Anthropic 主张,通过像 SB 53 这样的立法将透明度实践正式化,可以确保在竞争加剧或模型能力增长时,安全承诺不会被放弃。然而,公司也倡导建立联邦标准以确保国家层面的一致性。
他们提出的联邦框架包括五个核心原则:
- 公开的安全开发框架: 开发者必须发布他们如何评估和缓解严重风险(包括 CBRN 危害和模型自主性失调)的方法。
- 部署系统卡片: 在部署时必须披露总结了测试、评估程序、结果和缓解措施的公开文档,并在进行重大修改时进行更新。
- 举报人保护: 谎报合规情况或惩罚举报违规行为的员工必须是违法的。
- 灵活的透明度标准: 要求应当是轻量级的,并能适应 AI 开发不断演进的特性。
- 针对性应用: 监管应仅适用于最大的前沿开发者,以避免给小型初创公司和低风险模型带来负担。
合规背景
SB 53 建立了美国针对灾难性风险的首个前沿 AI 安全和透明度要求。Anthropic 支持该法律,因为它在安全实践、事件报告和举报人保护之间取得了平衡,同时在实施方面提供了灵活性,并为小型公司提供了豁免。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch