California SB 53를 위한 Anthropic Frontier Compliance Framework
Anthropic는 1월 1일부터 시행되는 캘리포니아의 Transparency in Frontier AI Act (SB 53)를 준수하기 위해 Frontier Compliance Framework (FCF)를 발표했습니다. 이 프레임워크는 회사가 프론티어 AI 모델과 관련된 파괴적인 위험을 어떻게 평가하고 관리하는지에 대한 공개 표준을 수립합니다.
Frontier Compliance Framework (FCF) Overview
Frontier Compliance Framework (FCF)는 Anthropic이 SB 53의 법적 요구 사항을 충족하기 위해 사용하는 주요 문서입니다. 이 문서는 다음과 같은 특정 고위험 위험을 평가하고 완화하기 위한 회사의 프로세스를 상세히 설명합니다:
- Catastrophic Threats: FCF는 사이버 공격, 화학, 생물학, 방사능 및 핵(CBRN) 위협뿐만 아니라 AI 사보타주 및 제어 상실과 관련된 위험을 다룹니다.
- Capability Evaluation: 이 프레임워크는 이러한 위험 범주에 대해 모델의 능력을 평가하기 위해 계층화된 시스템을 활용합니다.
- Operational Security: FCF는 모델 가중치를 보호하고 안전 사고에 대응하는 접근 방식을 개략적으로 설명합니다.
Relationship Between FCF and Responsible Scaling Policy (RSP)
FCF는 SB 53 및 기타 규제 요구 사항을 위한 의무적인 준수 문서인 반면, Anthropic의 Responsible Scaling Policy (RSP)는 이와 다릅니다. RSP는 회사의 내부적인 최선 사례를 반영하고 AI 환경이 변화함에 따라 진화하며, 잠재적으로 현재의 규제 명령을 초과할 수 있는 자발적인 안전 정책으로 남아 있습니다.
Advocacy for Federal AI Transparency Standards
Anthropic은 SB 53와 같은 입법을 통해 투명성 관행을 공식화함으로써 경쟁이 심화되거나 모델 능력이 성장함에 따라 안전 약속이 포기되지 않도록 보장할 수 있다고 주장합니다. 그러나 회사는 국가적 일관성을 보장하기 위해 연방 표준을 옹호합니다.
그들이 제안하는 연방 프레임워크에는 다섯 가지 핵심 원칙이 포함됩니다:
- Public Secure Development Frameworks: 개발자는 CBRN 위해를 포함하여 심각한 위험을 평가하고 완화하는 방법을 공개해야 합니다.
- Deployment System Cards: 배포 시 테스트, 평가 절차, 결과 및 완화 조치를 요약한 공개 문서를 공개해야 하며, 실질적인 수정이 있을 경우 업데이트해야 합니다.
- Whistleblower Protections: 준수 여부에 대해 거짓말을 하거나 위반 사항을 보고하는 직원을 처벌하는 것은 불법이어야 합니다.
- Flexible Transparency Standards: 요구 사항은 가볍고 AI 개발의 진화하는 특성을 수용할 수 있도록 적응 가능해야 합니다.
- Targeted Application: 규제는 소규모 스타트업과 저위험 모델에 부담을 주지 않도록 가장 큰 프론티어 개발사에게만 적용되어야 합니다.
Compliance Context
SB 53는 미국에서 파괴적인 위험에 대한 최초의 프론티어 AI 안전 및 투명성 요구 사항을 설정합니다. Anthropic은 이 법이 안전 관행, 사고 보고, 내부 고발자 보호와 구현의 유연성 및 소규모 기업을 위한 면제 조항 사이의 균형을 맞추고 있기 때문에 이 법을 지end적으로 지지했습니다.
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch