Claude Fable 5 と Claude Mythos 5 のリリース – 安全対策を備えた先進的な Mythos クラスモデルと段階的アクセス制度
TL;DR
Anthropic は、幅広いベンチマークでこれまでにリリースされた Anthropic モデルすべてを上回る性能を発揮する Mythos クラス 1 モデルである Claude Fable 5 の一般提供を発表しました。また、検証済みのサイバー防衛担当者および後日、生物学研究者向けに、より少ない安全制限を持つ限定リリース版である Mythos 5 も提供しています。両モデルの価格は入力トークン 100万トークンあたり 10ドル、出力トークン 100万トークンあたり 50ドルです。
Claude Fable 5 とは何か?
Claude Fable 5 は、Anthropic が一般公開に適していると判断した Mythos クラス 1 モデルです。ほぼすべての AI 機能ベンチマークで最先端の結果を達成しており、大規模なコード移行、複数ステップの科学的推論、視覚のみのインタラクションなど、長期的・複雑なタスクにおいて特に顕著な性能向上を示しています。
コア機能
- ソフトウェア工学 – Stripe のテストでは、Fable 5 は 5,000万行の Ruby コードベースを 1 日で移行完了させました。通常、この作業には 2 ヶ月の手作業が必要です。Cognition の FrontierCode ベンチマークでは、より少ないトークン数で最先端モデルの中でも最高スコアを記録しました。
- 知識作業 – Hebbia の Finance Benchmark では、上級者レベルの推論において最高スコアを達成。文書ベースの分析、チャート解釈、期待値計算において優れた性能を発揮しました。IMC は、このモデルが「事実の照会、根本原因分析、評価の各タスクで、トレーディング分析スイートを完璧にこなした」と報告しています。
- 視覚処理 – Fable 5 は、科学図表から正確な数値データを抽出でき、スクリーンショットからウェブアプリのソースコードを再構成でき、純粋なゲーム画像のみを使って Pokémon FireRed をプレイできます。これは、以前の Claude モデルが複雑な補助ハーネスを必要としていたのに対し、大幅な進歩です。
- 長期間コンテキスト記憶 – モデルは数百万トークンにわたって一貫性を保ち、永続的なメモを取ることで出力を改善できます。デッキビルディングゲーム『Slay the Spire』では、ファイルベースのメモリ拡張により、Claude Opus 4.8 と比較して成功率が3倍に向上しました。
- ライフサイエンス研究 – Mythos クラスのコアを活用し、Fable 5(Mythos 5 を通じて)はタンパク質設計パイプラインを約10倍に加速し、Opus クラスの出力よりも80%の頻度で好まれる新しい分子生物学仮説を生成し、最近の Science 論文を上回るゲノミクスモデルを、100倍小さいサイズで生成しました。
Claude Mythos 5 とは何か?
Claude Mythos 5 は、Fable 5 と同一の基盤モデルを共有していますが、いくつかの安全分類器を緩和しています。現在、米国政府との提携による Project Glasswing を通じて展開されており、少数のサイバー防衛担当者および重要なインフラ提供者にのみ提供されています。今後は、生物学研究者向けの信頼アクセスプログラムも展開予定です。
特徴的な点
- サイバーセキュリティに特化 – Mythos 5 は、公開されているモデルの中で最も強力な攻撃的・防御的サイバー能力を備えており、迅速な脆弱性発見、エクスプロイト生成、マルチステージ攻撃計画の立案を可能にします。
- 安全対策の軽減 – サイバー、生物学、化学、モデル蒸留に関するクエリでは、デフォルトの fallback として Claude Opus 4.8 に切り替わる仕組みが無効化され、信頼できる環境下で完全な能力を活用できます。
- 価格の同等性 – Mythos 5 は Fable 5 と同一の価格(入力トークン 100万トークンあたり 10ドル、出力トークン 100万トークンあたり 50ドル)で提供され、以前の Claude Mythos Preview と比較してコストが50%以上削減されています。
セキュリティアーキテクチャと安全対策
Anthropic は、Fable 5 の誤用を抑制しつつ、広範な利用を可能にするために、保守的な安全スタックを導入しました。
分類器ベースのリクエストルーティング
- 範囲 – 3つの分類器ドメイン:サイバー、生物学/化学、モデル蒸留。
- メカニズム – 分類器がリクエストを警告した場合、システムは明確に拒否するのではなく、自動的に Claude Opus 4.8(高度に能力の高いフォールバックモデル)にリクエストをルーティングします。
- 影響 – フォールバックは平均して 5%未満 のセッションで発生。95%以上 のセッションはリダイレクトなしで進行します。
ジェイルブレイクに対する耐性
- 内部のレッドチームテストおよび外部のバグバウンティ(1,000時間以上)では、万能なジェイルブレイクは発見されませんでした。
- 外部パートナーは、30種類の異なる公開ジェイルブレイク手法を用いても、悪意あるサイバークエリが1件も成功しなかったと報告しています。
- 比較グラフ(ソース画像を参照)では、Fable 5 の対策が、Opus 4.8 などの以前の一般公開モデルよりも、ジェイルブレイク攻撃に対してより効果的に抵抗していることが示されています。
データ保持ポリシー
- Mythos クラスモデルのすべてのトラフィックは、安全関連の分析のために 30日間のみ 保持されます。これは、新しい Claude モデルの訓練には使用されません。
- Anthropic は、保持されたデータへのすべての人的アクセスをログに記録し、保持期間終了後に削除するため、追加のプライバシー保護が実現されています。
早期利用者からのフィードバック
複数の早期アクセスパートナーが、生産性の劇的な向上を報告しています:
- CursorBench – Fable 5 は、長期的問題解決の新たな最先端記録を樹立し、その可能性を解放しました。
- GitHub – 開発者は、複雑で複数ステップにわたるコーディングタスクを自律的かつ信頼性高く処理できることを確認。『手渡し』型のエージェントワークフローへの移行が可能になりました。
- 法務レビュー – 弁護士は、Fable 5 の契約条項の赤字修正が、既存モデルと同等またはそれ以上であると指摘しました。
- 金融・分析 – モデルは Anthropic の主要分析ベンチマークで 90%の閾値を突破し、Opus 4.8 と比較して10ポイントの向上を達成しました。
- 科学的研究 – Fable 5 は、物理学研究ベンチマークで36時間でほぼ完全なカバレッジを達成。これは、GPT‑5.5 で4日分の作業に相当するスピードアップです。
(完全な引用文は、ソース画像のキャプションとして再現されています。上記の箇条書きは、報告された意見を要約したものです。)
価格と提供状況
- 価格 – 入力トークン 100万トークンあたり 10ドル、出力トークン 100万トークンあたり 50ドル(Claude Mythos Preview の半額未満)。
- 一般公開 – Claude Fable 5 は、すべての API ユーザーに即時利用可能。
- サブスクリプションプラン向け段階的展開 – リリースから6月22日まで、Pro、Max、Team、および席ベースのEnterpriseプランに含まれ、追加料金なし。その後は、容量が許すまで使用クレジットが必要になります。
- Mythos 5 – 現在は Glasswing パートナーに限定。生物学研究者向けの信頼アクセスプログラムは後日開設予定。
AIエコシステムへの影響
- 性能の限界 – Fable 5 は、自律的で長期間コンテキスト推論の新しい基準を確立し、ソフトウェア、金融、科学分野におけるAIと上級人間エキスパートとの間のギャップを縮めました。
- 安全最優先の展開 – 高リスクのクエリをやや能力が低いモデルにルーティングすることで、Anthropic は、誤用の可能性を抑えつつ強力なモデルをリリースする現実的なアプローチを示しました。
- 経済的影響 – 半額未満の価格設定により、企業ワークフローにおける先端モデルの採用が加速する可能性があり、AI補助開発や研究のコスト構造を変える可能性があります。
- 政策的意義 – 段階的信頼アクセスプログラムと30日間のデータ保持ルールは、開かれた性と国家安全保障の両立を実現する具体的なモデルを示しており、他の先端ラボが模倣する可能性があります。
上記で参照されたすべての図表、ベンチマークテーブル、および図解画像は、Anthropic の公式発表およびシステムカードから再現されています。
Sources
関連
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch