Anthropic Circuits Updates June 2024

Anthropic 在 2024 年 6 月發布了一系列初步研究更新,重點關注可解釋性、多智能體系統的系統性風險,以及尚未發布的研究版 Claude 在解決複雜數學問題方面的能力。這些更新作為一套正在發展中的想法和初步實驗,而非正式、成熟的論文。

Mathematical Capabilities and the Riemann Zeta Function

一個尚未發布的研究版 Claude 在與黎曼猜想相關的問題上展現了顯著進展。具體而言,該模型改進了滿足該猜想的 Riemann zeta function 零點比例的長期下限,將該下限從 41.6% 提高到了 67.2%。

Multiagent Systems and Systemic Failures

Anthropic 正在調查當前前沿模型在部署於多智能體系統時,可能導致意外系統性故障的行為傾向。這項研究的目標是識別這些模式,並就如何減輕相關風險展開討論。

Worker Retraining Programs

透過與獨立研究員 David Roodman 合作,Anthropic 的 Maxim Massenkoff 合著了一篇關於勞工再培訓計劃證據的綜述,探討這些計劃在 AI 驅動的經濟轉型背景下的有效性。

Research Status and Intent

Anthropic 的可解釋性團隊將這些更新描述為「正在發展中的想法」和「新興的研究方向」。該團隊明確要求將這些結果視為在同事之間分享的初步實驗,而非最終定稿、經過同行評審的研究論文。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch