Muse Glimmer リリース: Meta Superintelligence Labs による 30B エージェンティック・マルチモーダル・モデル

Meta Superintelligence Labs は、ローカルのエージェント・ワークロード向けに特別に設計された 30B マルチモーダル・モデルである Muse Glimmer をリリースしました。このモデルは Apache 2.0 ライセンスの下で Ollama で利用可能であり、コーディング・エージェントやパーソナル・アシスタント向けの、高コンテキストでオープンウェイトな代替手段を提供します。

コーディング・エージェントおよびアシスタント向けのローカル展開

Muse Glimmer は、ローカルで実行されるエージェンティック・アプリケーションを駆動するために最適化されています。128K+ トークンのコンテキスト長をサポートし、ollama launch コマンドを介して、いくつかのエージェント・フレームワークやパーソナル・アシスタント・ツールと互換性があります。

サポートされている統合は以下の通りです:

  • Coding Agents: Claude Code, Codex, Pi, および OpenCode。
  • Personal Assistants: OpenClaw および Hermes。
  • General Integrations: GitHub Copilot および Ollama の統合ドキュメントに記載されているその他のツール。

制御可能な推論強度

Muse Glimmer は、パフォーマンスと速度のバランスをとるために、ユーザーが推論強度を調整できるようにします。このモデルは 4 つの異なるレベルをサポートしています:

  • High と XHigh: 複雑なコーディングやエージェンティックなタスクに推奨されます。
  • Low と Medium: 実行速度が優先されるシナリオに推奨されます。

MLX エンジンによる Apple Silicon 最適化

Apple Silicon 上では、Muse Glimmer は Ollama の MLX エンジンを通じて最先端の性能を実現します。この実装には、2 つの主要な技術的強化が導入されています:

DFlash サポート

以前のマルチトークン予測 (MTP) サポートに基づき、MLX エンジンは現在 DFlash をサポートしています。この技術により、Muse Glimmer は Apple Silicon ハードウェア上で 1.5–1.8× 高速に動作します。

ネイティブな画像理解

Muse Glimmer は、専用の 1.8B パラメータの知覚エンコーダーを備えており、ネイティブな画像理解を提供します。MLX エンジンの新しい画像入力サポートにより、コーディング・エージェントは、以下を含む画像ベースのタスクに対して、低レイテンシで逐次的なツール呼び出しを実行できます:

  • 図面やモックアップをウェブサイトやアプリケーションに変換すること。
  • スクリーンショットを介してコンピュータ使用アプリケーションを駆動すること。
  • 文書、領収書、チャートからデータを抽出すること。

Sources

関連

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch