Muse Glimmer 发布:Meta Superintelligence Labs 的 30B 智能体多模态模型

Meta Superintelligence Labs 发布了 Muse Glimmer,这是一个专为本地智能体工作负载设计的 30B 多模态模型。该模型已在 Ollama 上发布,采用 Apache 2.0 许可,为编程智能体和个人助手提供了一个高上下文、开放权重的替代方案。

为编程智能体和助手提供本地部署

Muse Glimmer 经过优化,可为在本地运行的智能体应用提供动力。它支持 128K+ token 的上下文长度,并可通过 ollama launch 命令与多种智能体框架和个人助手工具兼容。

支持的集成包括:

  • 编程智能体:Claude Code, Codex, Pi, 和 OpenCode。
  • 个人助手:OpenClaw 和 Hermes。
  • 通用集成:GitHub Copilot 以及 Ollama 集成文档中列出的其他工具。

可控的推理强度

Muse Glimmer 允许用户调整推理强度,以平衡性能和速度。该模型支持四个不同的级别:

  • High 和 XHigh:推荐用于复杂的编程和智能体任务。
  • Low 和 Medium:推荐用于以执行速度为首要指标的场景。

通过 MLX 引擎进行 Apple Silicon 优化

在 Apple Silicon 上,Muse Glimmer 通过 Ollama 的 MLX 引擎实现了最先进的性能。此实现引入了两个主要的的技术增强:

DFlash 支持

在之前多 token 预测 (MTP) 支持的基础上,MLX 引擎现在支持 DFlash。这项技术使 Muse Glimmer 在 Apple Silicon 硬件上运行速度提升了 1.5–1.8×。

原生图像理解

Muse Glimmer 配备了专用的 1.8B 参数感知编码器,提供原生图像理解能力。MLX 引擎新的图像输入支持允许编程智能体针对基于图像的任务执行低延迟、顺序的工具调用,包括:

  • 将绘图或原型图转换为网站和应用程序。
  • 通过截图为计算机使用 (computer-use) 应用提供动力。
  • 从文档、收据和图表中提取数据。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch