Anthropic, Public First Action에 대한 지원을 4,000만 달러로 확대

Anthropic은 Public First Action에 2,000만 달러를 추가로 기부하여 총 지원 금액을 4,000만 달러로 늘렸습니다. 이 자금은 합리적인 AI 안전장치를 구축하기 위한 공공 교육 및 정책 미션에만 전적으로 사용되며, 연방, 주 또는 지방 선거에 영향을 미 미치는 데 사용할 수 없습니다.

AI 역량 및 관련 위험 가속화

AI 모델 역량의 급격한 발전은 즉각적인 정부 조치가 필요한 긴급한 보안 취약점을 생성하고 있습니다. Anthropic은 모든 주요 운영 체제와 브라우저 전반에서 수천 개의 고위험 소프트웨어 취약점을 발견한 Claude Mythos Preview의 사례를 언급했습니다. 이러한 취약점의 악용 위험을 완화하기 위해, Anthropic은 Project Glasswing을 통해 제한된 사이버 방어자 그룹에게 해당 모델을 공개했습니다.

한편, 고급 모델은 신약 개발 가속화, 질병 치료, 과학적 진보, 인간 수명 연장 및 경제 성장 등 상당한 잠재적 이점을 제공하지만, Anthropic은 이러한 이득을 실현하기 위해 재앙적 위험에 대한 보호 조치가 먼저 구축되어야 한다고 주장합니다. 회사는 정부가 이러한 위험을 관리하는 능력을 구축하는 동시에 이점을 포착할 수 있는 즉각적인 시간이 필요하다고 강조합니다.

프론티어 AI를 위한 제안된 정책 프레임워크

Anthropic은 AI 발전 속도를 고려할 때 투명성만으로는 불충분하다고 주장합니다. 회사는 Advanced AI Framework에 상세히 기술된 다음과 같은 요구 사항을 포함하는 포괄적인 위험 완화 접근 방식을 옹호합니다:

  • Verification and Enforcement: 정부는 안전성 주장을 검증하고, 민사적 처벌을 통해 안전한 관행을를 실천하도록 강제하며, 재앙적 피해의 심각한 위험을 초래하는 모델의 배포를 차단할 수 있는 능력을 갖추어야 합니다.
  • Testing and Evaluation: 프론티어 AI 개발자는 재앙적 위험에 대해 모델을 테스트하고, 발견 사항에 대한 투명성을 유지하며, 모델을 모델을 독립적인 평가에 제출하고, 강력한 보안 프로그램을 운영해야 합니다.

국가 안보 및 글로벌 AI 리더십

미국과 그 민주주의 동맹국들의 리더십을 유정을 위해, Anthropic은 첨단 기술이 권위주의 정권에 이익이 되는 것을 방지하기 위한 특정 국가 안보 조치를 지원합니다. 이러한 제안된 조치에는 다음이 포함됩니다:

  • Export Controls: 첨단 칩과 반도체 제조 장비에 대한 통제를 강화합니다.
  • Access Restrictions: 불법적인 모델 접근을 억제하고 증류 공격(distillation attacks)을 방지합니다.

Anthropic은 이러한 정책 프레임워크를 시작점으로 보고 있으며, Public First Action에 대한 지원을 통해 AI 안전 및 국가 안보를 둘러싼 긴급한 정책 논의의 중요성을 높이고자 합니다.

Sources

관련