Gemini 3 Deep Think アップデート

最先端の推論とアルゴリズム性能

  • Humanity’s Last Exam: ツールなしで 48.4% の正確度を達成し、最先端モデルの限界をテストするために設計されたベンチマークの新基準を設定しました。
  • ARC-AGI-2: 84.6% の正確度、ARC Prize Foundation によって検証済み。
  • Codeforces: 競技プログラミング課題で Elo 3455 を取得。
  • International Math Olympiad (IMO) 2025: 金メダルレベルのパフォーマンス。

科学分野での熟練度

数学とコーディングを超えて、更新された Deep Think モードは化学と物理学という広範な科学分野でも卓越しています。2025 年国際物理オリンピックおよび 2025 年化学オリンピックの筆記部門で金メダルレベルの結果を示しました。さらに、CMT-Benchmark で 50.5% のスコアを取得し、先進的な理論物理学における熟練度を示しています。

実用的なエンジニアリング応用

Gemini 3 Deep Think は抽象的な理論を超えて実用的な活用へと進むよう設計されています。このモデルは研究者が複雑なデータを解釈できるようにし、エンジニアがコードを通じて物理システムをモデル化できるようにします。この機能の具体的な応用例として、スケッチを解析し、複雑な形状をモデル化し、3D 印刷に必要なファイルを生成して、3D プリント可能なファイルに変換する能力があります。

利用可能性とアクセス

更新された Deep Think モードは、Google AI Ultra のサブスクライバー向け Gemini アプリですぐに利用可能です。初めて、Deep Think は選択された研究者、エンジニア、企業向けに Gemini API を通じて早期アクセスプログラムで提供されます。

Sources