Mistral Medium 3.5 与 Vibe 远程智能体发布
Mistral AI 推出了 Mistral Medium 3.5,这是一款专为长程编码和生产力设计的 128B 开源权重模型,同时在 Mistral Vibe 中推出了远程智能体,并在 Le Chat 中新增了“Work mode”。这些更新将编码智能体从本地环境转移到了云端,在保持人工监督的同时,实现了复杂任务的并行和异步执行。
Mistral Medium 3.5:技术规格与性能
Mistral Medium 3.5 是一款稠密型 128B 模型,它将指令遵循、推理和编码能力集成到一组权重中。它在修改后的 MIT 许可下发布,并在 Hugging Face 上提供开源权重。
关键技术能力
- Context Window: 该模型具有 256k 的上下文窗口。
- Hardware Efficiency: 该模型最少仅需四块 GPU 即可进行自托管。
- Configurable Reasoning: 推理力度可根据每个请求进行配置,允许模型在快速聊天响应和复杂的智能体运行之间切换。
- Vision Integration: 视觉编码器是从头开始训练的,以支持可变图像尺寸和长宽比。
基准测试
- SWE-Bench Verified: Mistral Medium 3.5 得分为 77.6%,优于 Devstral 2 和 Qwen3.5 397B A17B。
- τ³-Telecom: 该模型得分为 91.4,展示了强大的智能体能力。
Mistral Vibe 远程智能体
远程智能体将编码会话从本地笔记本电脑转移到云端,消除了开发者成为智能体执行每一步的瓶颈。这些智能体可以通过 Mistral Vibe CLI 和 Le Chat 使用。
异步编码工作流
- Parallel Execution: 开发者可以生成多个云端智能体来并行运行任务。
- Session Teleportation: 本地 CLI 会话可以“瞬间移动”到云端,并携带会话历史、任务状态和审批权限。
- Integration: Vibe 集成了 GitHub (code 和 pull requests)、Linear 和 Jira (issues)、Sentry (incidents) 以及 Slack 和 Teams 等通信工具。
- Sandbox Environment: 每个会话都在隔离的沙箱环境中运行,允许进行广泛的编辑和安装。
- Outcome-Based Review: 智能体可以打开 GitHub pull requests 并在完成后通知用户,允许开发者审查最终结果,而不是逐个按键。
Le Chat Work Mode (预览)
Work mode 是 Le Chat 的智能体执行后端,由 Mistral Medium 3.5 提供支持,专为需要试错和长期持久性的复杂、多步骤项目而设计。
智能体能力
- Cross-Tool Workflows: 智能体可以同时访问电子邮件、消息和日历,为会议做准备或处理收件箱。
- Administrative Automation: 智能体可以根据讨论内容创建 Jira issues 或向 Slack 发送摘要。
- Research and Synthesis: 智能体可以从网络、内部文档和连接的工具中综合信息,以生成结构化报告。
- Operational Transparency: 每一个工具调用和思考逻辑对用户都是可见的。敏感任务(例如,发送消息或修改数据)需要基于权限的明确用户批准。
可用性与定价
Mistral Medium 3.5 是 Le Chat 中的新默认模型,并取代了 Vibe CLI 中的 Devstral 2。它适用于 Pro、Team 和 Enterprise 计划。
API 定价
- Input Tokens: 每百万 token 消耗 $1.5。
- Output Tokens: 每百万 token 消耗 $7.5。
部署选项
- Hugging Face: 开源权重在修改后的 MIT 许可下提供。
- NVIDIA: 可通过 build.nvidia.com 上的 GPU 加速端点使用,并作为可扩展的容器化推理微服务通过 NVIDIA NIM 提供。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch