Mistral 3 リリースノート: Mistral Large 3 および Ministral 3 ファミリー

Mistral AI は、高容量の Mistral Large 3 とエッジに特化した Ministral 3 シリーズを含む、次世代モデル Mistral 3 を発表しました。このリリースのすべてのモデルは、分散型インテリジェンスと開発者によるカスタマイズをサポートするため、Apache 2.0 ライセンスの下で提供されます。

Mistral Large 3: フロンティア級のオープンウェイト性能

Mistral Large 3 は、総パラメータ数 675B、アクティブパラメータ数 41B を特徴とするスパース Mixture-of-Experts (MoE) モデルです。3,000 基の NVIDIA H200 GPU を使用してゼロからトレーニングされており、一般的なプロンプトに対して、主要な指示チューニング済みオープンウェイトモデルと同等の性能を達成するように設計されています。

主な機能とベンチマークは以下の通りです:

  • LMArena ランキング: Mistral Large 3 は、LMArena リーダーボードにおいて、OSS 非推論モデルカテゴリで 2 位、すべての OSS モデル全体で 6 位にランクされています。
  • マルチモーダルおよび多言語対応: このモデルは、画像理解能力を示し、英語および中国語以外の多言語会話においてクラス最高の性能を発揮します。
  • 利用可能性: ベースモデルと指示チューニング済み(Instruct)バージョンの両方が本日リリースされ、推論(Reasoning)バージョンは将来のリリースが予定されています。

Ministral 3: エッジ最適化されたインテリジェンス

Ministral 3 シリーズは、ローカルおよびエッジ環境へのデプロイメントにおいて、最先端の性能対コスト比を提供します。このファミリーは、3B、8B、14B パラメータの 3 つのモデルサイズで構成されています。

各サイズについて、Mistral AI は 3 つのバリアントをリリースしています:

  • Base: 基本的な事前学習済みモデル。
  • Instruct: 指示に従うことに最適化されており、これらのモデルは、同等のモデルと同等またはそれ以上の性能を発揮しながら、多くの場合、トークン生成量を 1 桁少なく抑えることができます。
  • Reasoning: 高精度タスク向けに設計されており、14B バリアントは AIME ’25 で 85% の精度を達成しました。

すべての Ministral 3 モデルには、ネイティブなマルチモーダル(画像理解)および多言語機能が含まれています。

ハードウェア最適化とエコシステム統合

Mistral AI は、NVIDIA、vLLM、および Red Hat と協力し、Mistral 3 がさまざまなハードウェア環境でアクセスしやすく、効率的であることを確認しました。

データセンターおよびエンタープライズ・デプロイメント

  • NVFP4 フォーマット: llm-compressor で作成された NVFP4 フォーマットのチェックポイントにより、Mistral Large 3 は、vLLM を使用して Blackwell NVL72 システム、または単一の 8×A100 または 8×H100 ノード上で効率的に実行できます。
  • NVIDIA 統合: すべての Mistral 3 モデルは、HBM3e メモリを備えた NVIDIA Hopper GPU 上でトレーニングされました。NVIDIA は、低精度実行を可能にするために TensorRT-LLM および SGLang への推論サポートを提供しました。
  • 高度なカーネル: Large 3 の MoE アーキテクチャのために、NVIDIA は Blackwell attention および MoE カーネルを統合し、GB200 NVL72 上での長文脈・高スループットのワークロードをサポートするために投機的デコーディング(speculative decoding)について協力しました。

エッジおよびローカル・デプロイメント

  • デバイスサポート: Ministral モデルは、DGX Spark、RTX PC、ノートパソコン、および Jetson デバイスへのデプロイメントに最適化されています。

利用可能性とカスタマイズ

Mistral 3 は、Mistral AI Studio、Amazon Bedrock、Azure Foundry、Hugging Face、Modal、IBM WatsonX、OpenRouter、Fireworks、Unsloth AI、および Together AI を通じて利用可能です。まもなく NVIDIA NIM および AWS SageMaker でも利用可能になります。

専門的な AI を必要とする組織向けに、Mistral AI は、ドメイン固有のタスクや独自のデータセットに合わせてモデルを微調整または完全に適応させるための、カスタムモデルトレーニングサービスを提供しています。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch