Muse Glimmer 출시: Meta Superintelligence Labs의 30B 에이전틱 멀티모달 모델

Meta Superintelligence Labs는 로컬 에이전트 워크로드를 위해 특별히 설계된 30B 멀티모달 모델인 Muse Glimmer를 출시했습니다. 이 모델은 Apache 2.0 라이선스 하에 Ollama에서 사용할 수 있으며, 코딩 에이전트 및 개인 비서를 위한 고컨텍스트, 오픈 웨이트 대안을 제공합니다.

코딩 에이전트 및 비서를 위한 로컬 배포

Muse Glimmer는 로컬에서 실행되는 에이전틱 애플리케이션을 구동하도록 최적화되었습니다. 128K+ 토큰의 컨텍스트 길이를 지원하며, ollama launch 명령어를 통해 여러 에이전트 프레임워크 및 개인 비서 도구와 호환됩니다.

지원되는 통합 기능은 다음과 같습니다:

  • 코딩 에이전트: Claude Code, Codex, Pi, 및 OpenCode.
  • 개인 비서: OpenClaw 및 Hermes.
  • 일반 통합: GitHub Copilot 및 Ollama의 통합 문서에 나열된 기타 도구.

조절 가능한 추론 강도

Muse Glimmer는 사용자가 성능과 속도의 균형을 맞추기 위해 추론 강도를 조정할 수 있도록 합니다. 이 모델은 네 가지 별도의 수준을 지원합니다:

  • High and XHigh: 복잡한 코딩 및 에이전틱 작업에 권장됩니다.
  • Low and Medium: 실행 속도가 우선순위인 시나리오에 권장됩니다.

MLX 엔진을 통한 Apple Silicon 최적화

Apple Silicon에서 Muse Glimmer는 Ollama의 MLX 엔진을 통해 최첨단 성능을 달성합니다. 이 구현은 두 가지 주요 기술적 향상을 도입합니다:

DFlash 지원

이전의 멀티 토큰 예측(MTP) 지원을 기반으로, MLX 엔진은 이제 DFlash를 지원합니다. 이 기술을 통해 Muse Glimmer는 Apple Silicon 하드웨어에서 1.5–1.8배 더 빠르게 실행됩니다.

네이티브 이미지 이해

Muse Glimmer는 전용 1.8B-파라미터 인지 인코더를 특징으로 하며, 네이티브 이미지 이해를 제공합니다. MLX 엔진의 새로운 이미지 입력 지원을 통해 코딩 에이전트는 다음과 같은 이미지 기반 작업에 대해 저지연, 순차적 도구 호출을 수행할 수 있습니다:

  • 그림이나 목업을 웹사이트 및 애플리케이션으로 변환.
  • 스크린샷을 통한 컴퓨터 사용 애플리케이션 구동.
  • 문서, 영수증 및 차트에서 데이터 추출.

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch