Anthropic Transparency Hub 출시

Anthropic은 회사의 안전 프로토콜, 위험 완화 전략 및 책임 있는 확장 프로세스에 대한 상세한 통찰력을 제공하는 중앙 집중식 리소스인 Transparency Hub를 출시했습니다. 이 이니셔티브는 AI 역량이 발전하고 규제 프레임워크가 진화함에 따라 신뢰와 책임성을 구축하기 위해 설계되었습니다.

AI 거버넌스를 위한 통합 프레임워크

Anthropic의 Transparency Hub는 다양한 투명성 이니셔티브와 자발적 약속의 다양하고 종종 중복되는 문서화 요구 사항을 해결하기 위한 통합 프레임워크 역할을 합니다. 이 정보를 통합함으로써, 회사는 사용자, 정책 입안자 및 이해관계자에게 모델이 어떻게 개발되고 배포되는지에 대한 구조화되고 접근 가능한 뷰를 제공하는 것을 목표로 합니다.

주요 투명성 지표 및 보고

Anthropic은 특정 운영 지표를 포함하는 첫 번째 정기 보고서를 발행하고 있습니다. 이러한 지표에는 다음 데이터가 포함됩니다:

  • 차단된 계정
  • 계정 이의 신청 및 이의 신청 인용
  • National Center for Missing and Exploited Children (NCMEC)에 접수된 보고
  • 정부 요청 데이터

제공되는 정보의 범위

Transparency Hub는 AI 개발 및 개발 운영의 여러 중요한 영역에 걸쳐 상세한 정보를 제공합니다:

  • Model Evaluation and Safety Testing: 모델을 평가하고 안전성을 테스트하는 데 사용되는 방법론.
  • Platform Abuse Detection: 플랫폼 남용을 탐지하고 이에 대응하기 위해 구현된 조치.
  • Platform Security: 개발 프로세스 전반에 걸쳐 구현된 보안 및 개인정보 보호 보호 장치.
  • Governance and Risk: 내부 거버넌스 정책 및 위험 평가 전략.
  • Societal Impact: 잠재적인 사회적 영향을 평가하고 해결하기 위한 방법.
  • AI Safety Research: AI 안전 분야의 전반적인 발전을 목표로 하는 연구 이니셔티브.

투명성에 대한 지속적인 약속

Anthropic은 Transparency Hub가 시작점이라고 밝혔습니다. 회사는 AI 역량이 발전하고 새로운 과제가 등장함에 따라 진화하는 모범 사례를 반영하기 위해 보고 범위를 지속적으로 확장할 것을 약속합니다.

Sources

관련