Mistral AI Devstral モデルのリリース

Mistral AIは、All Hands AIと協力して、Devstral MediumおよびアップグレードされたDevstral Small 1.1を導入しました。これらのモデルは、エージェンティックなコーディング能力を強化するために設計されており、さまざまなプロンプトやエージェンティックなスキャフォールド(scaffolds)にわたる汎用性を強調し、自律的なソフトウェア開発を向上させることを目的としています。

Devstral Small 1.1: オープンソースのエージェンティック・コーディング

Devstral Small 1.1は、Apache 2.0ライセンスの下でリリースされた24Bパラメータのモデルであり、テスト時スケーリング(test-time scaling)を行わないオープンモデルにおいて、新たなSOTA(state-of-the-art)を確立しました。これは、ローカル展開やコミュニティによるカスタマイズ向けに設計されています。

パフォーマンスとベンチマーク

Devstral Small 1.1は、SWE-bench Verifiedにおいて53.6%のスコアを達成しました。このパフォーマンスにより、同カテゴリーのコードエージェント用オープンモデルとしてトップクラスの性能を実現しています。

多様性と統合

このモデルは、コーディング環境やプロンプトに対する汎用性の向上を示しています。特にOpenHandsでの使用に最適化されており、XML形式とMistral function callingの両方をサポートしているため、幅広いエージェンティックなスキャフォールドへの統合が可能です。

Devstral Medium: 高性能なエンタープライズ・コーディング

Devstral Mediumは、API経由で利用可能な高性能モデルであり、企業や開発者向けにコストとパフォーマンスのバランスを最適化するように設計されています。Gemini 2.5 ProやGPT 4.1の性能を上回りながら、コストは4分の1に抑えられています。

パフォーマンスと展開オプション

Devstral Mediumは、SWE-bench Verifiedにおいて61.6%のスコアを達成しました。エンタープライズユーザー向けには、パブリックAPIを通じて利用可能であるほか、データプライバシーを強化するためにプライベートなインフラストラ上で展開することも可能であり、さらに、特定の要件に合わせてパフォーマンスを調整するためのfinetuning APIを介したカスタム・ファインチューニングもサポートしています。

モデルの可用性と価格設定

両モデルともMistral AI APIを通じてアクセス可能であり、以下の価格体系となっています:

  • devstral-small-2507: 入力トークン100万あたり$0.1、出力トークン100万あたり$0.3(Mistral Small 3.1と同等)。
  • devstral-medium-2507: 入力トークン100万あたり$0.4、出力トークン100万あたり$2(Mistral Medium 3と同等)。

Devstral Small 1.1は、Hugging Face上のモデルカードからApache 2.0ライセンスの下でダウンロード可能です。Devstral Mediumは、エンタープライズ顧客向けにMistral Codeおよびfinetuning APIを通じて提供されます。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch