Muse Glimmer 출시: Meta Superintelligence Labs의 30B 에이전틱 멀티모달 모델
Meta Superintelligence Labs는 로컬 에이전트 워크로드를 위해 특별히 설계된 30B 멀티모달 모델인 Muse Glimmer를 출시했습니다. 이 모델은 Apache 2.0 라이선스 하에 Ollama에서 사용할 수 있으며, 코딩 에이전트 및 개인 비서를 위한 고컨텍스트, 오픈 웨이트 대안을 제공합니다.
코딩 에이전트 및 비서를 위한 로컬 배포
Muse Glimmer는 로컬에서 실행되는 에이전틱 애플리케이션을 구동하도록 최적화되었습니다. 128K+ 토큰의 컨텍스트 길이를 지원하며, ollama launch 명령어를 통해 여러 에이전트 프레임워크 및 개인 비서 도구와 호환됩니다.
지원되는 통합 기능은 다음과 같습니다:
- 코딩 에이전트: Claude Code, Codex, Pi, 및 OpenCode.
- 개인 비서: OpenClaw 및 Hermes.
- 일반 통합: GitHub Copilot 및 Ollama의 통합 문서에 나열된 기타 도구.
조절 가능한 추론 강도
Muse Glimmer는 사용자가 성능과 속도의 균형을 맞추기 위해 추론 강도를 조정할 수 있도록 합니다. 이 모델은 네 가지 별도의 수준을 지원합니다:
- High and XHigh: 복잡한 코딩 및 에이전틱 작업에 권장됩니다.
- Low and Medium: 실행 속도가 우선순위인 시나리오에 권장됩니다.
MLX 엔진을 통한 Apple Silicon 최적화
Apple Silicon에서 Muse Glimmer는 Ollama의 MLX 엔진을 통해 최첨단 성능을 달성합니다. 이 구현은 두 가지 주요 기술적 향상을 도입합니다:
DFlash 지원
이전의 멀티 토큰 예측(MTP) 지원을 기반으로, MLX 엔진은 이제 DFlash를 지원합니다. 이 기술을 통해 Muse Glimmer는 Apple Silicon 하드웨어에서 1.5–1.8배 더 빠르게 실행됩니다.
네이티브 이미지 이해
Muse Glimmer는 전용 1.8B-파라미터 인지 인코더를 특징으로 하며, 네이티브 이미지 이해를 제공합니다. MLX 엔진의 새로운 이미지 입력 지원을 통해 코딩 에이전트는 다음과 같은 이미지 기반 작업에 대해 저지연, 순차적 도구 호출을 수행할 수 있습니다:
- 그림이나 목업을 웹사이트 및 애플리케이션으로 변환.
- 스크린샷을 통한 컴퓨터 사용 애플리케이션 구동.
- 문서, 영수증 및 차트에서 데이터 추출.
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch