Mistral AI Devstral 모델 출시

Mistral AI는 All Hands AI와 협력하여 Devstral Medium 및 업그레이드된 Devstral Small 1.1을 출시했습니다. 이 모델들은 다양한 프롬프트와 에이전트 스캐폴드(agentic scaffolds)에 대한 일반화 능력을 강조하여 에이전트 기반 코딩 능력을 향상시키도록 설계되었습니다. 자율 소프트웨어 개발을 개선하기 위해 설계되었습니다.

Devstral Small 1.1: 오픈 소스 에이전트 코딩

Devstral Small 1.1은 Apache 2.0 라이선스 하에 출시된 24B 파라미터 모델로, 테스트 시간 스케일링(test-time scaling) 없이 오픈 모델 분야에서 새로운 SOTA(state-of-the-art)를 구축했습니다. 로컬 배포 및 커뮤니티 커스터마이징을 위해 설계되었습니다.

성능 및 벤치마크

Devstral Small 1.1은 SWE-bench Verified에서 53.6%의 점수를 달성했습니다. 이 성능은 해당 카테고리에서 코드 에이전트를 위한 선도적인 오픈 모델로 만들어 줍니다.

다재다능함 및 통합

이 모델은 코딩 환경 및 프롬프트에 대한 개선된 일반화 능력을 보여줍니다. 특히 OpenHands와 함께 사용하도록 최적화되어 있으며 XML 형식과 Mistral function calling을 모두 지원하여 다양한 에이전트 스캐폴드에 통합될 수 있습니다.

Devstral Medium: 고성능 엔터프라이즈 코딩

Devstral Medium은 API를 통해 사용할 수 있는 고성능 모델로, 기업과 개발자를 위해 비용과 성능의 균형을 맞추도록 설계되었습니다. Gemini 2.5 Pro 및 GPT 4.1보다 뛰어난 성능을 보여주면서도 비용은 4분의 1 수준입니다.

성능 및 배포 옵션

Devstral Medium은 SWE-bench Verified에서 61.6%의 점수를 달성했습니다. 엔터프라이즈 사용자를 위해 이 모델은 공개 API를 통해 제공되며, 데이터 프라이버시 강화를 위해 프라이빗 인프라에 배포할 수 있으며, finetuning API를 통해 특정 요구 사항에 맞게 성능을 조정할 수 있는 커스텀 파인튜닝을 지원합니다.

모델 가용성 및 가격 정책

두 모델 모두 Mistral AI API를 통해 다음과 같은 가격 구조로 접근할 수 있습니다:

  • devstral-small-2507: 입력 토큰 100만 개당 $0.1, 출력 토큰 100만 개당 $0.3 (Mistral Small 3.1과 동일).
  • devstral-medium-2507: 입력 토큰 100만 개당 $0.4, 출력 토큰 100만 개당 $2 (Mistral Medium 3와 동일).

Devstral Small 1.1은 Hugging Face의 모델 카드를 통해 Apache 2.0 라이선스 하에 다운로드할 수 있습니다. Devstral Medium은 Mistral Code 및 finetuning API를를 통해 엔터프라이즈 고객에게 제공됩니다.

Sources

관련

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch