Mistral Medium 3 發佈說明
Mistral AI 已宣布推出 Mistral Medium 3,這是一款新型語言模型,旨在以顯著降低的成本和更高的部署靈活性,提供前沿級別的性能。此次發佈旨在通過提供一個能與更大、更昂貴的競爭對手競爭的模型,同時保持在相對適度的硬體上即可部署,從而降低企業 AI 集成的成本。
性能與成本效率
Mistral Medium 3 提供前沿級別的性能,同時其成本比同類模型低了一個數量級。在各項基準測試中,其表現達到或超過 Claude Sonnet 3.7 的 90%,定價結構為每百萬個輸入 token 為 $0.4,每百萬個輸出 token 為 $2。
在競爭定位方面,Mistral Medium 3 超越了領先的開源模型,如 Llama 4 Maverick,以及企業級模型,如 Cohere Command A。它在 API 和自部署系統配置中,也擊敗了像 DeepSeek v3 這樣的成本領先者。
技術能力與專業使用場景
Mistral Medium 3 針對專業使用場景進行了優化,特別是在編碼、STEM 任務和多模態理解方面表現出色。根據內部評估流程,該模型在這些領域的準確性使其能夠與更大、更慢的競爭對手進行密切競爭。
第三方人工評估進一步支持了這些發現,表明 Mistral Medium 3 在編碼領域提供的性能優於其多個較大的競爭對手。
企業部署與定制化
Mistral Medium 3 旨在深度集成到企業系統中,支持多種部署模式以滿足安全和隱私要求:
- 部署選項: 該模型支持混合、本地或在-VPC 部署。它可以在由四個 GPU 或更多組成的環境中進行自託管。
- 定制化: 通過 Mistral 的應用 AI 解決方案,該模型支持持續預訓練、全量微調以及融入企業知識庫以進行特定領域的訓練和自適應工作流。
醫療保健、能源和金融服務領域的 Beta 客戶目前正利用該模型進行複雜數據集分析、業務流程個性化以及通過深度上下文豐富客戶服務。
可用性
Mistral Medium 3 可立即通過 Mistral La Plateforme 和 Amazon Sagemaker 使用。可用性正在擴展,以包含 IBM WatsonX、NVIDIA NIM、Azure AI Foundry 和 Google Cloud Vertex。
關於未來發佈,Mistral AI 表示預計將在未來幾週內發佈一個新的「大型」模型。
Sources
- OriginalMedium is the new large.
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch