Mistral AI Devstral 模型发布
Mistral AI 与 All Hands AI 合作,推出了 Devstral Medium 和升级版的 Devstral Small 1.1。这些模型旨在增强智能体编程能力,强调在各种提示词和智能体框架(agentic scaffolds)中的泛化能力,以提升自主软件开发水平。
Devstral Small 1.1:开源智能体编程
Devstral Small 1.1 是一个基于 Apache 2.0 协议发布的 24B 参数模型,为无需测试时扩展(test-time scaling)的开源模型树立了新的标杆。它专为本地部署和社区定制而设计。
性能与基准测试
Devstral Small 1.1 在 SWE-bench Verified 上取得了 53.6% 的评分。这一性能使其成为同类别中代码智能体领先的开源模型。
多功能性与集成
该模型在编程环境和提示词方面的泛化能力得到了提升。它专门针对 OpenHands 进行了优化,并支持 XML 格式和 Mistral function calling,使其能够集成到广泛的智能体框架中。
Devstral Medium:高性能企业级编程
Devstral Medium 是一款通过 API 提供的性能卓越的模型,旨在为企业和开发者平衡成本与性能。其性能超越了 Gemini 2.5 Pro 和 GPT 4.1,而成本仅为后者的四分之一。
性能与部署选项
Devstral Medium 在 SWE-bench Verified 上取得了 61.6% 的评分。对于企业用户,该模型可通过公共 API 使用,也可以部署在私有基础设施上以增强数据隐私,并支持通过 finetuning API 进行自定义微调,以根据特定需求定制性能。
模型可用性与定价
两种模型均可通过 Mistral AI API 访问,定价结构如下:
- devstral-small-2507: 每百万输入 token 价格为 $0.1,每百万输出 token 价格为 $0.3(与 Mistral Small 3.1 相当)。
- devstral-medium-2507: 每百万输入 token 价格为 $0.4,每百万输出 token 价格为 $2(与 Mistral Medium 3 相当)。
Devstral Small 1.1 可通过 Hugging Face 上的模型卡片按 Apache 2.0 协议下载。Devstral Medium 可通过 Mistral Code 和 finetuning API 为企业客户提供。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch