Anthropic Transparency Hub Launch
Anthropic 推出了 Transparency Hub,这是一个集中的资源库,旨在提供有关公司安全协议、风险缓解策略和负责任的扩展流程的详细见解。随着 AI 能力的进步和监管框架的演变,这一举措旨在建立信任和问责制。
Unified Framework for AI Governance
Anthropic 的 Transparency Hub 作为一个统一的框架,旨在应对各种透明度倡议和自愿承诺中多样且往往重叠的文档要求。通过整合这些信息,公司旨在为用户、政策制定者和利益相关者提供一个结构化且易于获取的视图,展示其模型是如何开发和部署的。
Key Transparency Metrics and Reporting
Anthropic 正在发布其首份定期报告,其中包含特定的运营指标。这些指标包括以下数据:
- Banned accounts
- Account appeals and appeal overturns
- Reports made to the National Center for Missing and Exploited Children (NCMEC)
- Government request data
Scope of Information Provided
Transparency Hub 在 AI 开发和开发运营的几个关键领域提供详细信息:
- Model Evaluation and Safety Testing: 使用于评估模型和进行安全测试的方法论。
- Platform Abuse Detection: 为检测和打击平台滥用而实施的措施。
- Platform Security: 在整个开发过程中实施的安全和隐私保护措施。
- Governance and Risk: 内部治理政策和风险评估策略。
- Societal Impact: 评估和应对潜在社会影响的方法。
- AI Safety Research: 旨在推进 AI 安全通用领域的研发计划。
Ongoing Commitment to Transparency
Anthropic 已表示,Transparency Hub 只是一个起点。随着 AI 能力的进步和新挑战的出现,公司承诺将不断扩大其报告范围,以反映不断演变的最佳实践。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch