Mistral AI La Plateforme 发布
Mistral AI 推出了 La Plateforme,这是一个 beta API 服务,为开发者提供三个生成式聊天端点和一个嵌入模型。此次发布使得 Mistral AI 的开源生成式模型能够在生产环境中进行高效部署和定制。
Generative Model Endpoints
Mistral AI 提供三个聊天端点,用于根据文本指令生成文本,每个端点在性能和成本之间提供不同的平衡:
Mistral-tiny
Mistral-tiny 是最具成本效益的端点。它目前提供 Mistral 7B Instruct v0.2 服务,这是 Mistral 7B Instruct 模型的次要版本。该端点仅限于英语,并在 MT-Bench 上获得了 7.6 分。
Mistral-small
Mistral-small 提供 Mixtral 8x7B 模型服务。该模型支持英语、法语、意大利语、德语和西班牙语,以及代码。它在 MT-Bench 上获得了 8.3 分。
Mistral-medium
Mistral-medium 是最高质量的端点,提供一个原型模型服务,该模型根据标准基准测试排名处于顶级服务模型之列。与 Mistral-small 一样,它支持英语、法语、意大利语、德语和西班牙语,以及代码。它在 MT-Bench 上获得了 8.6 分。
Embedding Capabilities
Mistral AI 推出了 Mistral-embed 端点,该端点提供专门为检索能力设计的嵌入模型。该模型具有 1024 维的嵌入维度,并在 MTEB 上获得了 55.26 的检索分数。
API Specifications and Integration
La Plateforme 的 API 遵循流行聊天接口的规范,以方便开发者轻松过渡。为了支持集成,Mistral AI 提供了 Python 和 Javascript 客户端库。该 API 允许使用系统提示词(system prompts)来针对特定应用需求,对模型输出实施更高水平的审核。
Technical Implementation and Alignment
在 La Plateforme 上提供服务的模型是 Mistral AI 基础模型的指令微调版本,这些基础模型是在开放的 Web 数据上进行预训练的,然后通过标注进行指令微调。对齐过程结合使用了高效微调和直接偏好优化(DPO),以确保模型易于控制且使用体验良好。
Availability and Infrastructure
La Plateforme 目前处于 beta 访问阶段,随着容量的逐步提升,注册已向所有用户开放。Mistral AI 感谢 NVIDIA 在集成 TensorRT-LLM 和 Triton 方面的支持,特别是在使稀疏混合专家(MoE)模型与 TRT-LLM 兼容方面。
Sources
- OriginalLa Plateforme
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch