Mistral AI Devstral 模型发布

Mistral AI 与 All Hands AI 合作,推出了 Devstral Medium 和升级版的 Devstral Small 1.1。这些模型旨在增强智能体编程能力,强调在各种提示词和智能体框架(agentic scaffolds)中的泛化能力,以提升自主软件开发水平。

Devstral Small 1.1:开源智能体编程

Devstral Small 1.1 是一个基于 Apache 2.0 协议发布的 24B 参数模型,为无需测试时扩展(test-time scaling)的开源模型树立了新的标杆。它专为本地部署和社区定制而设计。

性能与基准测试

Devstral Small 1.1 在 SWE-bench Verified 上取得了 53.6% 的评分。这一性能使其成为同类别中代码智能体领先的开源模型。

多功能性与集成

该模型在编程环境和提示词方面的泛化能力得到了提升。它专门针对 OpenHands 进行了优化,并支持 XML 格式和 Mistral function calling,使其能够集成到广泛的智能体框架中。

Devstral Medium:高性能企业级编程

Devstral Medium 是一款通过 API 提供的性能卓越的模型,旨在为企业和开发者平衡成本与性能。其性能超越了 Gemini 2.5 Pro 和 GPT 4.1,而成本仅为后者的四分之一。

性能与部署选项

Devstral Medium 在 SWE-bench Verified 上取得了 61.6% 的评分。对于企业用户,该模型可通过公共 API 使用,也可以部署在私有基础设施上以增强数据隐私,并支持通过 finetuning API 进行自定义微调,以根据特定需求定制性能。

模型可用性与定价

两种模型均可通过 Mistral AI API 访问,定价结构如下:

  • devstral-small-2507: 每百万输入 token 价格为 $0.1,每百万输出 token 价格为 $0.3(与 Mistral Small 3.1 相当)。
  • devstral-medium-2507: 每百万输入 token 价格为 $0.4,每百万输出 token 价格为 $2(与 Mistral Medium 3 相当)。

Devstral Small 1.1 可通过 Hugging Face 上的模型卡片按 Apache 2.0 协议下载。Devstral Medium 可通过 Mistral Code 和 finetuning API 为企业客户提供。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch