Anthropic Transparency Hub Launch
Anthropic 已推出 Transparency Hub,這是一個提供有關公司安全協定、風險緩解策略和負責任擴展流程詳細見解的集中式資源。隨著 AI 能力的進步和監管框架的演變,此舉旨在建立信任與問責制。
Unified Framework for AI Governance
Anthropic 的 Transparency Hub 作為一個統一的框架,旨在應對各種透明度倡議和自願承諾中多樣且往往重疊的文件要求。透過整合這些資訊,公司旨在為使用者、政策制定者和利益相關者提供一個結構化且易於獲取的視角,以了解其模型是如何開發和部署的。
Key Transparency Metrics and Reporting
Anthropic 正在發布其首份定期報告,其中包含特定的營運指標。這些指標包括以下數據:
- Banned accounts
- Account appeals and appeal overturns
- Reports made to the National Center for Missing and Exploited Children (NCMEC)
- Government request data
Scope of Information Provided
Transparency Hub 在 AI 開發和開發營運的幾個關鍵領域提供詳細資訊:
- Model Evaluation and Safety Testing: 使用於評估模型和進行安全測試的方法論。
- Platform Abuse Detection: 為檢測和打擊平台濫用而實施的措施。
- Platform Security: 在整個開發過程中實施的安全和隱私保障措施。
- Governance and Risk: 內部治理政策和風險評估策略。
- Societal Impact: 評估和應對潛在社會影響的方法。
- AI Safety Research: 旨在推進 AI 安全通用領域的研究倡議。
Ongoing Commitment to Transparency
Anthropic 已表示,Transparency Hub 僅是一個起點。隨著 AI 能力的進步和新挑戰的出現,公司承諾將持續擴展其報告內容,以反映不斷演變的最佳實踐。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch