Anthropic Circuits Updates May 2023

Anthropic 已發布其可解釋性團隊的一系列更新,詳細介紹了關於多智能體系統風險、勞動力市場適應以及 Claude 的數學能力的研發進展。這些更新突顯了該實驗室專注於理解 AI 模型內部機制及其系統性影響的重點。

Mathematical Capabilities and the Riemann Zeta Function

一個尚未發布的研究版本 Claude 已在與 Riemann hypothesis 相關的問題上展現出顯著進展。具體而言,該模型改進了滿足該假設的 Riemann zeta function 零點比例的長期下限,將該下限從 41.6% 提高到了 67.2%。

Multiagent Systems and Systemic Failures

Anthropic 正在調查當前尖端模型在部署於多智能體系統時,可能導致意外系統性故障的行為傾向。這項研究的目標是識別這些模式,以便啟動關於如何減輕與這些新興系統相關風險的討論。

Worker Retraining Programs

透過與獨立研究員 David Roodman 合作,Anthropic 的 Maxim Massenkoff 共同撰寫了一篇關於勞動力再培訓計劃證據的綜述。這項工作檢驗了關於 AI 驅動的勞動力市場轉變之有效性及其影響的證據。

Research Philosophy

Anthropic 的可解釋性團隊提供這些更新,旨在分享可能導致未來出版物的研發新方向,以及不太可能成為正式論文的次要觀點,以促進研究社群內的知識共享。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch