Mistral Small 3.1 릴리스 노트

Mistral AI는 다중 모달 이해 기능과 확장된 128k 토큰 컨텍스트 창을 통합한 고성능 소형 모델인 Mistral Small 3.1을 출시했습니다. 이번 릴리스는 여러 차원에서 선도적인 소형 전용 모델을 능가하는 텍스트 성능, 다중 모달 기능, 지연 시간 측면에서 처음으로 오픈소스 모델이 달성한 중요한 성과입니다.

기술 사양 및 성능

Mistral Small 3.1은 GPT-4o Mini 및 Gemma 3과 같은 유사 모델보다 뛰어난 성능을 발휘하면서도 초당 150토큰의 높은 추론 속도를 유지합니다. 이 모델은 텍스트, 다중 모달 입력, 다양한 언어를 처리할 수 있는 능력과 낮은 지연 시간 및 비용 효율성을 균형 있게 설계했습니다.

하드웨어 요구 사항

Mistral Small 3.1은 가벼운 배포를 최적화했습니다. 단일 NVIDIA RTX 4090 GPU 또는 32GB RAM을 갖춘 맥에서 실행 가능하여, 디바이스 내 AI 애플리케이션에 매우 적합합니다.

컨텍스트 및 라이선스

  • 컨텍스트 창: 최대 128k 토큰을 지원하여 더 긴 문서 및 더 복잡한 프롬프트 처리가 가능합니다.
  • 라이선스: Mistral Small 3.1은 Apache 2.0 라이선스 하에 출시되어 오픈소스 개발 및 상용 사용에 넓은 접근성을 제공합니다.

핵심 기능 및 활용 사례

Mistral Small 3.1은 지시사항 준수, 대화형 지원, 이미지 이해, 함수 호출이 가능한 유연한 모델로, 소비자용 및 기업용 AI 애플리케이션의 기반을 제공합니다.

주요 적용 분야

  • 대화형 AI: 빠르고 정확한 응답이 중요한 빠른 반응 가상 비서
  • 에이전트 워크플로우: 자동화 시스템 내에서 빠른 실행을 위한 낮은 지연 시간의 함수 호출
  • 도메인 특화: 의료 진단, 법적 조언, 기술 지원과 같은 전문 분야에 맞춰 미세 조정이 가능
  • 다중 모달 기업 업무: 이미지 기반 고객 지원, 문서 인증, 진단, 품질 검사용 시각적 점검, 보안 시스템 내 객체 탐지

모델 접근성 및 생태계

Mistral AI는 후속 사용자 맞춤화 및 고급 추론 모델 개발을 가능하게 하기 위해 사전 훈련된 기본 모델과 지시 체크포인트를 모두 공개했습니다.

배포 채널

  • 오픈 웨이트: Hugging Face에서 다운로드 가능 (Mistral Small 3.1 Base 및 Mistral Small 3.1 Instruct)
  • API 접근: 개발자 플레이그라운드인 La Plateforme를 통해 이용 가능
  • 클라우드 플랫폼: Google Cloud Vertex AI에서 이용 가능하며, NVIDIA NIM 및 Microsoft Azure AI Foundry에서도 곧 출시 예정

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch