Mistral Medium 3.5 및 Vibe 원격 에이전트 출시
Mistral AI는 장기적인 코딩 및 생산성을 위해 설계된 128B 오픈 웨이트 모델인 Mistral Medium 3.5와 함께, Mistral Vibe의 원격 에이전트 및 Le Chat의 새로운 "Work mode"를 출시했습니다. 이러한 업데이트는 코딩 에이전트를 로컬 환경에서 클라우드로 전환하여, 인간의 감독을 유지하면서 복잡한 작업을 병렬 및 비동기적으로 실행할 수 있도록 합니다.
Mistral Medium 3.5: 기술 사양 및 성능
Mistral Medium 3.5는 지시 이행, 추론 및 코딩 능력을 단일 가중치 세트에 통합한 밀집(dense) 128B 모델입니다. 이 모델은 수정된 MIT 라이선스 하에 출시되었으며, Hugging Face에서 오픈 웨이트를 사용할 수 있습니다.
주요 기술 능력
- Context Window: 모델은 256k 컨텍스트 창을 특징으로 합니다.
- Hardware Efficiency: 모델은 최소 4개의 GPU에서 자체 호스팅이 가능합니다.
- Configurable Reasoning: 추론 노력(reasoning effort)은 요청마다 설정할 수 있어, 모델이 빠른 채팅 응답과 복잡한 에이전트 실행 사이를 전환할 수 있습니다.
- Vision Integration: 비전 인코더는 다양한 이미지 크기와 종횡비를 지원하기 위해 처음부터 학습되었습니다.
벤치마크
- SWE-Bench Verified: Mistral Medium 3.5는 77.6%를 기록하여 Devstral 2 및 Qwen3.5 397B A17B를 능가합니다.
- τ³-Telecom: 모델은 91.4점을 기록하여 강력한 에이전트 능력을 입증했습니다.
Mistral Vibe 원격 에이전트
원격 에이전트는 코딩 세션을 로컬 노트북에서 클라우드로 이동시켜, 개발자가 에이전트 실행의 모든 단계에서 병목 현상이 되는 것을 방지합니다. 이러한 에이전트들은 Mistral Vibe CLI 및 Le Chat을 통해 사용할 수 있습니다.
비동기 코딩 워크플로우
- Parallel Execution: 개발자는 여러 개의 클라우드 에이전트를 생성하여 작업을 병렬로 실행할 수 있습니다.
- Session Teleportation: 로컬 CLI 세션은 세션 기록, 작업 상태 및 승인을 포함하여 클라우드로 "텔레포트"될 수 있습니다.
- Integration: Vibe는 GitHub (코드 및 풀 리퀘스트), Linear 및 Jira (이슈), Sentry (인시던트), 그리고 Slack 및 Teams와 같은 통신 도구를 통합합니다.
- Sandbox Environment: 각 세션은 광범위한 편집 및 설치를 허용하는 격리된 샌드박스 환경에서 실행됩니다.
- Outcome-Based Review: 에이전트는 GitHub 풀 리퀘스트를 생성할 수 있으며, 완료 시 사용자에게 알림을 보내 최종 결과물을 검토할 수 있게 하여 개발자가 개별 키 입력 대신 최종 결과물을 검토하도록 합니다.
Le Chat Work Mode (Preview)
Work mode는 Le Chat을 위한 에이전트 실행 백엔드이며, Mistral Medium 3.5를 기반으로 하여 시행착오와 장기적인 지속성이 필요한 복잡하고 다단계 프로젝트를 위해 설계되었습니다.
에이전트 능력
- Cross-Tool Workflows: 에이전트는 회의 준비나 편지함 분류를 위해 이메일, 메시지, 캘린더에 동시에 접근할 수 있습니다.
- Research and Synthesis: 에이전트는 웹, 내부 문서 및 연결된 도구를 통해 정보를 합성하여 구조화된 보고서를 생성할 수 있습니다.
- Administrative Automation: 에이전트는 토론 내용을 바탕으로 Jira 이슈를 생성하거나 Slack으로 요약본을을 보낼 수 있습니다.
- Operational Transparency: 모든 도구 호출 및 추론 근거는 사용자에게 공개됩니다. 민감한 작업(예: 메시지 전송 또는 데이터 수정)은 권한에 기반하여 사용자의 명시적인 승인이 필요합니다.
가용성 및 가격
Mistral Medium 3.5는 Le Chat의 새로운 기본 모델이며 Vibe CLI의 Devstral 2를 대체합니다. Pro, Team, 및 Enterprise 플랜에서 사용할 수 있습니다.
API 가격
- Input Tokens: 100만 토큰당 $1.5입니다.
- Output Tokens: 100만 토큰당 $7.5입니다.
배포 옵션
- Hugging Face: 수정된 MIT 라이선스 하에 오픈 웨이트를 사용할 수 있습니다.
- NVIDIA: build.nvidia.com의 GPU 가속 엔드포인트 및 NVIDIA NIM을 통한 확장 가능한 컨테이너화된 추론 마이크로서비스로 사용할 수 있습니다.",
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch