Ollama Cloud에서 MiniMax M2 출시
MiniMax M2는 이제 Ollama의 클라우드에서 사용할 수 있으며, 코딩 및 에이전트 워크플로우에 특화되어 설계된 모델을 제공합니다. 이 모델은 개발자 환경에 통합되고 도구 사용을 통해 복잡하고 장기적인 작업을 자동화하도록 설계되었습니다.
일반 지능 및 벤치마크
Artificial Analysis 지능 지수에 따르면 MiniMax M2는 전 세계 오픈 소스 모델 중 최상위 순위를 차지합니다. 종합 점수에서 1위를 기록하며 수학, 과학, 지시 이행, 코딩 및 에이전트 도구 사용 전반에 걸쳐 경쟁력 있는 일반 지능을 입증했습니다.
코딩 능력
MiniMax M2는 엔드 투 엔드 개발자 워크플로우를 위해 구축되었습니다. 다음과 같은 여러 실용적인 응용 분야에서 뛰어난 성능을 발휘합니다:
- Multi-file edits: 여러 파일을 동시에 편집할 수 있습니다.
- Coding-run-fix loops: 코드 작성, 실행 및 수정의 반복적인 개발 사이클을 지원합니다.
- Test-validated repairs: 테스트로 검증된 수정을 수행할 수 있습니다.
다양한 언어에 걸친 터미널, IDE 및 CI 환경에서의 효과는 Terminal-Bench 및 (Multi-)SWE-Bench 스타일의 작업에서 보여주는 강력한 성능을 통해 입증되었습니다.
에이전트 성능 및 도구 사용
MiniMax M2는 복잡하고 장기적인 도구 체인을 계획하고 실행하도록 설계되었습니다. shell, browser, retrieval, 그리고 code runner를 가로질러 작동할 수 있습니다. BrowseComp 스타일의 평가에서 이 모델은 찾기 어려운 소스를 일관적으로 찾아내고, 추적 가능한 증거를 유지하며, 불안정한 단계에서 우아하게 복구합니다.
모델 아키텍처 및 효율성
MiniMax M2는 총 2300억 개의 파라미터 중 100억 개의 활성화된 파라미터를 사용하는 효율적인 설계를 활용합니다. 이 아키텍처는 더 낮은 지연 시간, 더 낮은 비용, 더 높은 처리량을 가능하게 하여 대화형 에이전트 및 배치 샘플링에 적합하게 만듭니다.
배포 및 통합
MiniMax M2는 ollama run minimax-m2:cloud 또는 Ollama Cloud API를 통해 액세스할 수 있습니다. 다음과 같은 여러 인기 있는 코딩 도구 및 IDE와 통합됩니다:
- VS Code: copilot chat 사이드바와 provider 드롭다운을 통해 액세스할 수 있습니다.
- Zed: agent 패널의 LLM providers 설정에서 통합됩니다.
- Droid:
~/.factory/config.json에서 generic-chat-completion-api provider를 사용하여 구성할 수 있습니다. - 기타 통합: Ollama는 Codex, Cline, 그리고 Roo code와 함께 모델을 사용하는 방법에 대한 문서를 제공합니다.
API 액세스
minimax-m2:cloud와 같은 클라우드 모델은 API 키를 사용하여 Ollama Cloud API를 통해 직접 액세스할 수 있습니다. 요청은 모델이 minimax-m2로 지정된 https://ollama.com/api/chat으로 전송됩니다.
Sources
- OriginalMiniMax M2
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch