Anthropic Circuits Updates June 2024
Anthropic 在 2024 年 6 月发布了一系列初步研究更新,重点关注可解释性、多智能体系统的系统性风险,以及尚未发布的 Claude 研究版本解决复杂数学问题的能力。这些更新作为一套正在发展的想法和初步实验,而非正式、成熟的论文。
Mathematical Capabilities and the Riemann Zeta Function
一个尚未发布的 Claude 研究版本在与黎曼猜想相关的问题上取得了显著进展。具体而言,该模型提高了满足该猜想的 Riemann zeta function 零点比例的长期下限,将该下限从 41.6% 提高到了 67.2%。
Multiagent Systems and Systemic Failures
Anthropic 正在调查当前前沿模型在部署于多智能体系统中时可能导致意外系统性故障的行为倾向。这项研究的目标是识别这些模式,并就如何减轻相关风险展开讨论。
Worker Retraining Programs
通过与独立研究员 David Roodman 合作,Anthropic 的 Maxim Massenkoff 共同撰写了一篇关于工人再培训计划证据的综述,探讨了这些计划在 AI 驱动的经济变革背景下的有效性。
Research Status and Intent
Anthropic 的可解释性团队将这些更新描述为“正在发展的想法”和“新兴的研究方向”。该团队明确要求将这些结果视为同事间分享的初步实验,而非最终定稿、经过同行评审的研究论文。
Sources
- OriginalCircuits Updates – June 2024
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch