Mistral Small 3.1 发布说明

Mistral AI 发布了 Mistral Small 3.1,这是一款集成了多模态理解能力并扩展了 128k token 上下文窗口的高性能轻量级模型。此次发布具有重要意义,因为它是第一个在文本性能、多模态能力和延迟方面在多个维度上超越领先的闭源小参数量模型(proprietary models)的开源模型。

Technical Specifications and Performance

Mistral Small 3.1 的性能优于 GPT-4o Mini 和 Gemma 3 等同类模型,同时保持了每秒 150 tokens 的高推理速度。该模型旨在平衡低延迟和成本效率,并具备处理文本、多模态输入和多种语言的能力。

Hardware Requirements

Mistral Small 3.1 针对轻量级部署进行了优化。它可以在单张 NVIDIA RTX 4090 GPU 或配备 32GB RAM 的 Mac 上运行,非常适合于端侧 AI 应用场景。

Context and Licensing

  • Context Window: 这种模型支持高达 128k tokens,允许处理更长的文档和更复杂的提示词(prompts)。
  • Licensing: Mistral Small 3.1 根据 Apache 2.0 协议进行发布,为开源开发和商业用途提供了广泛的可访问性。

Core Capabilities and Use Cases

Mistral Small 3.1 是一款多功能模型,能够进行指令遵循、对话式助手功能、图像理解和函数调用(function calling)。它可作为消费级 AI 应用的基础模型。

Key Application Areas

  • Conversational AI: 在快速且准确的响应是关键的场景中,提供快速响应的虚拟助手。
  • Agentic Workflows: 在自动化系统中进行快速执行的低延迟函数调用(function calling)。
  • Domain Specialization: 该模型可以针对医疗诊断、法律咨询和技术支持等专业领域进行微调(fine-tuning)。
  • Multimodal Enterprise Tasks: 该模型支持基于图像的客户支持、文档验证、诊断、质量检查的视觉检测以及安全系统中的目标检测。

Model Availability and Ecosystem

Mistral AI 发布了预训练基础模型(pretrained base model)和指令微调版(instruct checkpoint),以支持下游定制化开发和高级推理模型(reasoning models)的开发。

Distribution Channels

  • Open Weights: 可在 Hugging Face 上下载(Mistral Small 0.3 Base 和 Mistral Small 3.1 Instruct)。
  • API Access: 可通过开发者平台 La Plateforme 访问。
  • Cloud Platforms: 可在 Google Cloud Vertex AI 上使用,即将通过 NVIDIA NIM 和 Microsoft Azure AI Foundry 提供服务。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch