Mistral AI Magistral 发布说明
Mistral AI 宣布推出 Magistral,这是其首个专为特定领域、透明且多语言推理设计的推理模型。此次发布引入了一个能够进行多步审议和分析的系统,解决了早期思考模型在专业深度不足以及不同语言间推理不一致等方面的局限性。
模型变体与性能
Magistral 提供两个不同的版本,以平衡易用性与性能:
- Magistral Small: 一个基于 Apache 2.0 许可的开源 24B 参数模型。
- Magistral Medium: 一个更强大的企业级版本。
在 AIME2024 的基准测试性能方面,Magistral Medium 获得了 73.6% 的分数,在使用 majority voting @64 时上升至 90%。Magistral Small 分别紧随其后,获得 70.7% 和 83.3%。
技术能力与特性
透明推理与思维链
Magistral 针对多步逻辑进行了微调,能够在用户的母语中提供可追溯的思维过程。与通用模型不同,这种方法提高了可解释性,并允许用户验证通向结论的逻辑步骤。
多语言灵活性
该模型在各种全球语言和字母表中保持了高保真度的推理。它专门针对包括 English, French, Spanish, German, Italian, Arabic, Russian, 和 Simplified Chinese 在内的语言进行了优化。
Le Chat 中的高速推理
通过 Le Chat 中的 "Think mode" 和 "Flash Answers" 功能,Magistral Medium 的 Token 吞吐量比大多数竞争对手快多达 10 倍,从而实现了大规模的实时推理和用户反馈。
企业与领域应用
Magistral 专为透明度和精确度至关重要的用例设计,例如:
- 受监管行业: 为法律、金融、医疗和政府部门提供可审计性和可追溯的推理,以满足合规性要求。
- 系统与软件工程: 通过涉及 API 或外部工具的序列化、多步操作,改进项目规划、后端架构和数据工程。
- 商业策略: 执行风险评估、运营优化和数据驱动的决策,包括在约束条件下计算最佳交付窗口。
- 内容创作: 作为连贯或奇特的叙事和创意写作的创意伙伴。
可用性与部署
Magistral Small 是一个可通过 Hugging Face 下载的开放权重模型。Magistral Medium 可在 Le Chat 中作为预览版使用,通过 La Plateforme 的 API 使用,以及在 Amazon SageMaker 上使用,并即将在 IBM WatsonX, Azure AI, 和 Google Cloud Marketplace 上提供。
Sources
- OriginalMagistral
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch