Mistral Medium 3 发布说明
Mistral AI 宣布推出 Mistral Medium 3,这是一种新型语言模型,旨在以显著更低的成本和更高的部署灵活性提供前沿水平的性能。此次发布旨在通过提供一个既能与规模更大、价格更昂贵的竞争对手相媲美,又能在相对适度的硬件上进行部署的模型,来降低企业 AI 集成的成本。
性能与成本效率
Mistral Medium 3 在提供前沿级性能的同时,其成本比同类模型低了一个数量级。在各项基准测试中,其表现达到或超过了 Claude Sonnet 3.7 的 90%,其定价结构为每百万输入 token 为 $0.4,每百万输出 token 为 $2。
技术能力与专业应用场景
Mistral Medium 3 针对专业应用场景进行了优化,特别是在编程、STEM 任务和多模态理解方面表现出色。根据内部评估流程,该模型在这些领域的准确性使其能够与更大、更慢的竞争对手展开激烈竞争。
企业级部署与定制化
Mistral Medium 3 旨在深度集成到企业系统中,支持多种部署模式以满足安全和隐私要求:
- 部署选项: 该模型支持混合、本地或在-VPC 部署。它可以在由四个或更多 GPU 组成的运行环境中进行自托管。
- 定制化: 通过 Mistral 的应用 AI 解决方案,该模型支持持续预训练、全量微调以及融入企业知识库进行特定领域的训练和自适应工作流。
目前,医疗保健、能源和金融服务领域的 Beta 客户正在利用该模型进行复杂数据集分析、业务流程个性化以及通过深度上下文丰富客户服务。
可用性
Mistral Medium 3 已通过 Mistral La Plateforme 和 Amazon Sagemaker 立即提供。可用性正在扩展,以涵盖 IBM WatsonX、NVIDIA NIM、Azure AI Foundry 和 Google Cloud Vertex。
关于未来的发布,Mistral AI 表示预计将在未来几周内发布一个新的“大型”模型。
Sources
- OriginalMedium is the new large.
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch