Gemma 4 リリースノート:高度知能オープンモデル(推論とエージェント向け)

Gemma 4 リリースノート:高度知能オープンモデル(推論とエージェント向け)

Google DeepMind は、Apache 2.0 ライセンスの下で提供されるオープンモデルのファミリーである Gemma 4 をリリースしました。このモデルは高度な推論、エージェントワークフロー、そしてデバイス上での効率的なデプロイを目的としています。

モデルのバリエーションとパフォーマンス

  • 31B Dense: 最高品質を目指し、ファインチューニングの基盤として設計されています。現在、Arena AI テキストリーダーボードで世界トップのオープンモデルとして #3 位にランクされています。
  • 26B Mixture of Experts (MoE): 低レイテンシー向けに最適化され、推論時に 38 億パラメータのみがアクティブになります。Arena AI テキストリーダーボードで #6 位です。
  • Effective 4B (E4B): エッジ向けに最適化されたモデルで、マルチモーダル機能とモバイル・IoT デバイス向けの低レイテンシ処理を重視しています。
  • Effective 2B (E2B): 非常に効率的なエッジモデルで、電話や Raspberry Pi などのデバイスで RAM とバッテリー消費を最小限に抑えるよう設計されています。

主な技術的機能

高度な推論とエージェントワークフロー

これらのモデルはマルチステップの計画と高度な論理処理が可能で、数学や指示遵守ベンチマークで大幅な向上を示しています。自律エージェントをサポートするため、Gemma 4 は関数呼び出し、構造化された JSON 出力、ネイティブなシステム指示へのネイティブサポートを備えています。

マルチモーダル処理

すべての Gemma 4 モデルはビデオと画像をネイティブに処理し、可変解像度や OCR、チャート理解といったタスクをサポートします。E2B と E4B のエッジモデルはさらに、音声認識と理解のためのネイティブ音声入力を備えています。

コンテキストウィンドウと多言語サポート

大きな 26B と 31B モデルは最大 256K トークンのコンテキストウィンドウを提供し、エッジモデル(E2B と E4B)は 128K のコンテキストウィンドウを備えています。このファミリーは 140 以上の言語でネイティブにトレーニングされています。

コード生成

Gemma 4 は高品質なオフラインコード生成をサポートし、ローカルファーストの AI コーディングアシスタントを実現します。

ハードウェア最適化とデプロイ

パーソナルコンピュータとワークステーション

26B と 31B モデルの非量子化 bfloat16 重みは、単一の 80GB NVIDIA H100 GPU に収まります。量子化バージョンはコンシューマー GPU 用に提供され、ローカル IDE とエージェントワークフローをサポートします。

モバイルおよび IoT エッジデバイス

E2B と E4B モデルは、Android デバイス、Raspberry Pi、NVIDIA Jetson Orin Nano 上でオフラインかつほぼゼロレイテンシで実行できるよう、最大のメモリ効率を目指して設計されています。Android 開発者は Gemini Nano 4 との互換性を持つ AICore Developer Preview を通じてこれらのフローをプロトタイプできます。

ライセンスとエコシステム

Apache 2.0 ライセンス

Gemma 4 は商業的に許容的な Apache 2.0 ライセンスの下でリリースされ、開発者はデータ、インフラストラクチャ、モデルに対して完全なコントロールを持つことができます。

統合とツール

Gemma 4 は、以下を含む幅広いプラットフォームとツールでリリース日からサポートされています。

  • Model Hubs: Hugging Face、Kaggle、Ollama。
  • Frameworks: Transformers、TRL、vLLM、llama.cpp、MLX、Keras。
  • Deployment: Google AI Studio、Vertex AI、Cloud Run、GKE、NVIDIA NIM。
  • Hardware: NVIDIA(Jetson Orin Nano から Blackwell GPU まで)、AMD(ROCm スタック経由)、Google TPU(Trillium と Ironwood)。

"Gemma 4 を Apache 2.0 ライセンスでリリースしたことは大きなマイルストーンです。リリース日から Hugging Face で Gemma 4 ファミリーをサポートできることに非常に興奮しています。"

— Clément Delangue, co-founder and CEO, Hugging Face

SUMMARY: Google DeepMind は、Apache 2.0 ライセンスの下で提供されるオープンモデルのファミリーである Gemma 4 をリリースしました。このモデルは高度な推論、エージェントワークフロー、そしてデバイス上での効率的なデプロイを目的としています。

TITLE: Gemma 4 リリースノート:高度知能オープンモデル(推論とエージェント向け)

Sources