Anthropic 再帰的自己改善の進捗と傾向

AI は AI システムの開発を加速させている

Anthropic は、AI 開発サイクルを AI システムに委ねることをますます増やしており、その結果、生産性の目に見える加速と、AI システムが自律的に自身の後継者を設計・開発する「再帰的自己改善」への軌道がもたらされています。完全な再帰的自己改善はまだ現実ではありませんが、内部データは、AI がフロンティアモデルの構築に必要なエンジニアリングおよび研究タスクの相当な部分をすでに実行していることを示しています。

エンジニアリングにおける定量化可能な生産性の向上

AI エージェントは、単純なコードスニペットの生成から、コードを実行し仕事を委任できる自律的なエージェントへと移行しました。この移行により、Anthropic におけるコード生産量は大幅に急増しています。

  • Code Authorship: 2026 年 5 月時点で、Anthropic のコードベースにマージされたコードの 80% 以上が Claude によって作成されました。比較として、この数値は 2025 年 2 月の Claude Code のリリース前には一桁台でした。
  • Engineer Output: 2026 年第 2 四半期において、典型的な Anthropic のエンジニアは、1 日あたり 8 つのコード(2024 年と同等)をマージしました。
  • Task Success Rates: 最もオープンエンドなエンジニアリングタスクにおいて、Claude の成功率は 2026 年 5 月に 76% に達し、6 か月間で 50 パーセントポイント増加しました。
  • Bug Detection: 回顧的な分析によれば、自動化された Claude によるレビューは、過去に claude.ai で発生したインシデントの原因となったバグの約 3 分 1 を、本番環境に到達する前に検出できていた可能性があります。

AI 研究能力の進歩

コードを書くこと以外にも、AI システムは実験の最適化において超人的なパフォーマンスを示しており、自ら研究の方向性を提案する能力も高まっています。

  • Experimental Optimization: Claude がトレーニングコードを可能な限り高速に実行するように求められたテストにおいて、Claude Mythos Preview は 2026 年 4 月までに約 52 倍の高速化を達成しました。これは 2025 年 5 月の Claude Opus 4 による約 3 倍と比較して大幅な向上です。熟練した人間の研究者は、通常、4 倍の高速化に到達するのに 4 時間から 8 時間を要します。
  • Autonomous Research: 2026 年 4 月、Claude を搭載したエージェントは、オープンエンドな AI 安全性研究プロジェクトを実施しました。これらのエージェントは、累積 800 時間にわたって、弱い監督者と強力なモデルとの間のパフォーマンス・ギャップを 97% 回復させましたが、一方で 2 人の人間の研究者は 1 週間で 23% しか回復させませんでした。
  • Research Judgment: 調査問題における「より良い次のステップ」を選択する能力を測定するテストにおいて、Mythos Preview モデルは 2026 年 4 月に人間の選択を 64% の確率で上回りました。これは 2025 年 11 月の Opus 4.5 の 51% から上昇しています。

再帰的自己改善への道

Anthropic は、開発プロセスにおける人間の役割が狭まっていることを指摘しています。現在のボトルネックは、「実行(コーディングと実験の実行)」から「方向付け(研究のセンスと判断)」へと移行しています。

Potential Future Scenarios

  1. Stall/S-Curve: スケーリングの収益逓減、Transformer のアーキテクチャ上の限界、またはエネルギーや計算資源のサプライチェーンのような物理的制約により、進捗が停滞する可能性があります。
  2. Compounding Efficiency: AI は研究の実行を自動化し続けますが、人間は研究の方向性を決める主要な設計者として留まります。これにより、100 人の企業が 100,000 人規模の組織が行う仕事をこなすことが可能になります。
  3. Full Recursive Self-Improvement: AI システムが変革的な独創性を備え、自らの後継者を設計します。このシナリオでは、進捗のペースは利用可能な計算資源のみによって制限されます。

批判的な視点と反論

Anthropic は指数関数的な成長の軌道を示していますが、外部の観察者や従業員は、これらの主張の妥当性と安全性に関するいくつかの懸念を表明しています。

  • Metric Validity: 批判者は、「行数」は生産性の不適切な代理指標であり、AI がより効率的な解決策ではなく、単わり単に冗長なコードを生成しているだけである可能性があると主張しています。
  • Operational Stability: 一部のユーザーは、超人的なコーディング能力の主張にもかかわらず、Anthropic のサービスが頻繁な停止や API スロットリングに悩まされていると報告しており、マーケティングの主張とユーザー体験の間の乖離が生じています。
  • Safety Paradox: 再帰的自己改善を全力で追求することと、AI 安全性の確保という掲げられた目標との両立性については懐疑的な見方があります。

"I fail to see how pursuing recursive self-improvement at full speed is highly compatible with Anthropic's stated goal of AI Safety. If nukes were not invented yet, would it really be a good idea to build and sell them as fast as possible?"

  • Hardware Bottlenecks: 一部の主張によれば、真の制約はハードウェアの効率性(例:compute-in-memory)であり、ソフトウェア・レベルの再帰的改善はこれらの物理的限界を克服できないとされています。

連携と「一時停止の選択肢」

Anthropic は、検証可能なグローバルな調整メカニズムが存在すれば、社会構造やアライメント研究が追いつくように、フロンティア AI 開発を減速または一時停止することが有益であると示唆しています。しかし、彼らは、トレーニング・ランの隠蔽が容易であるため、そのような一時停止は困難であると指摘しています。これは、アクターが離脱して競争的な優ードを維持しようとする強いインセンティブを生じさせます。

Sources