Anthropic 为加州 SB 53 法案发布的前沿合规框架

Anthropic 已发布其前沿合规框架 (FCF),以遵守将于 1 月 1 日生效的加州《前沿 AI 透明度法案》(SB 53)。该框架为公司如何评估和管理与前沿 AI 模型相关的灾难性风险建立了一个公开标准。

前沿合规框架 (FCF) 概述

前沿合规框架 (FCF) 是 Anthropic 用于满足 SB 53 法律要求的核心文件。它详细说明了公司评估和缓解特定高风险风险的过程,包括:

  • 灾难性威胁: FCF 涵盖了网络攻击、化学、生物、放射性及核 (CBRN) 威胁,以及与 AI 破坏和失去控制相关的风险。
  • 能力评估: 该框架利用分层系统,针对这些风险类别评估模型能力。
  • 运营安全: FCF 概述了保护模型权重并应对安全事件的方法。

FCF 与负责任扩展政策 (RSP) 的关系

虽然 FCF 是满足 SB 53 及其他监管要求的强制性合规文件,但它与 Anthropic 的负责任扩展政策 (RSP) 不同。RSP 仍是一项自愿性安全政策,反映了公司的内部最佳实践,并随着 AI 领域的变革而演进,其标准可能超过当前的监管指令。

倡导联邦 AI 透明度标准

Anthropic 主张,通过像 SB 53 这样的立法将透明度实践正式化,可以确保在竞争加剧或模型能力增长时,安全承诺不会被放弃。然而,公司也倡导建立联邦标准以确保国家层面的一致性。

他们提出的联邦框架包括五个核心原则:

  1. 公开的安全开发框架: 开发者必须发布他们如何评估和缓解严重风险(包括 CBRN 危害和模型自主性失调)的方法。
  2. 部署系统卡片: 在部署时必须披露总结了测试、评估程序、结果和缓解措施的公开文档,并在进行重大修改时进行更新。
  3. 举报人保护: 谎报合规情况或惩罚举报违规行为的员工必须是违法的。
  4. 灵活的透明度标准: 要求应当是轻量级的,并能适应 AI 开发不断演进的特性。
  5. 针对性应用: 监管应仅适用于最大的前沿开发者,以避免给小型初创公司和低风险模型带来负担。

合规背景

SB 53 建立了美国针对灾难性风险的首个前沿 AI 安全和透明度要求。Anthropic 支持该法律,因为它在安全实践、事件报告和举报人保护之间取得了平衡,同时在实施方面提供了灵活性,并为小型公司提供了豁免。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch