Anthropic Transparency Hub Launch

Anthropic 推出了 Transparency Hub,这是一个集中的资源库,旨在提供有关公司安全协议、风险缓解策略和负责任的扩展流程的详细见解。随着 AI 能力的进步和监管框架的演变,这一举措旨在建立信任和问责制。

Unified Framework for AI Governance

Anthropic 的 Transparency Hub 作为一个统一的框架,旨在应对各种透明度倡议和自愿承诺中多样且往往重叠的文档要求。通过整合这些信息,公司旨在为用户、政策制定者和利益相关者提供一个结构化且易于获取的视图,展示其模型是如何开发和部署的。

Key Transparency Metrics and Reporting

Anthropic 正在发布其首份定期报告,其中包含特定的运营指标。这些指标包括以下数据:

  • Banned accounts
  • Account appeals and appeal overturns
  • Reports made to the National Center for Missing and Exploited Children (NCMEC)
  • Government request data

Scope of Information Provided

Transparency Hub 在 AI 开发和开发运营的几个关键领域提供详细信息:

  • Model Evaluation and Safety Testing: 使用于评估模型和进行安全测试的方法论。
  • Platform Abuse Detection: 为检测和打击平台滥用而实施的措施。
  • Platform Security: 在整个开发过程中实施的安全和隐私保护措施。
  • Governance and Risk: 内部治理政策和风险评估策略。
  • Societal Impact: 评估和应对潜在社会影响的方法。
  • AI Safety Research: 旨在推进 AI 安全通用领域的研发计划。

Ongoing Commitment to Transparency

Anthropic 已表示,Transparency Hub 只是一个起点。随着 AI 能力的进步和新挑战的出现,公司承诺将不断扩大其报告范围,以反映不断演变的最佳实践。

Sources

相关