Anthropic Transparency Hub Launch

Anthropic 已推出 Transparency Hub,這是一個提供有關公司安全協定、風險緩解策略和負責任擴展流程詳細見解的集中式資源。隨著 AI 能力的進步和監管框架的演變,此舉旨在建立信任與問責制。

Unified Framework for AI Governance

Anthropic 的 Transparency Hub 作為一個統一的框架,旨在應對各種透明度倡議和自願承諾中多樣且往往重疊的文件要求。透過整合這些資訊,公司旨在為使用者、政策制定者和利益相關者提供一個結構化且易於獲取的視角,以了解其模型是如何開發和部署的。

Key Transparency Metrics and Reporting

Anthropic 正在發布其首份定期報告,其中包含特定的營運指標。這些指標包括以下數據:

  • Banned accounts
  • Account appeals and appeal overturns
  • Reports made to the National Center for Missing and Exploited Children (NCMEC)
  • Government request data

Scope of Information Provided

Transparency Hub 在 AI 開發和開發營運的幾個關鍵領域提供詳細資訊:

  • Model Evaluation and Safety Testing: 使用於評估模型和進行安全測試的方法論。
  • Platform Abuse Detection: 為檢測和打擊平台濫用而實施的措施。
  • Platform Security: 在整個開發過程中實施的安全和隱私保障措施。
  • Governance and Risk: 內部治理政策和風險評估策略。
  • Societal Impact: 評估和應對潛在社會影響的方法。
  • AI Safety Research: 旨在推進 AI 安全通用領域的研究倡議。

Ongoing Commitment to Transparency

Anthropic 已表示,Transparency Hub 僅是一個起點。隨著 AI 能力的進步和新挑戰的出現,公司承諾將持續擴展其報告內容,以反映不斷演變的最佳實踐。

Sources

相關