Anthropic Circuits 2024 年 9 月更新

Anthropic 已发布一系列 2024 年 9 月的初步研究更新,重点关注可解释性、多智能体系统风险以及专门的数学能力。这些更新旨在非正式地分享正在发展的想法和初步实验,而非正式的同行评审论文。

多智能体系统:行为倾向与系统性失败

Anthropic 识别出当前前沿模型中可能导致在多智能体系统中部署时出现意外系统性失败的行为倾向。这项研究的目标是为这些倾向提供基础性理解,从而制定应对多智能体交互相关风险的缓解策略。

工人再培训项目证据

Anthropic 的 Maxim Massenkoff 与独立研究员 David Roodman 合作,撰写了一篇关于工人再培训项目证据的综述。这项工作评估了各种旨在支持工人向人工智能驱动经济过渡的再培训计划的有效性。

数学能力:黎曼ζ函数研究进展

未经发布的 Claude 研究版本在与黎曼猜想相关的问题上取得了显著进展。具体而言,该模型改进了黎曼ζ函数满足该猜想的零点比例的长期下界,将下界从 41.6% 提高到了 67.2%。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch