Mistral Medium 3.5 与 Vibe 远程智能体发布

Mistral AI 推出了 Mistral Medium 3.5,这是一款专为长程编码和生产力设计的 128B 开源权重模型,同时在 Mistral Vibe 中推出了远程智能体,并在 Le Chat 中新增了“Work mode”。这些更新将编码智能体从本地环境转移到了云端,在保持人工监督的同时,实现了复杂任务的并行和异步执行。

Mistral Medium 3.5:技术规格与性能

Mistral Medium 3.5 是一款稠密型 128B 模型,它将指令遵循、推理和编码能力集成到一组权重中。它在修改后的 MIT 许可下发布,并在 Hugging Face 上提供开源权重。

关键技术能力

  • Context Window: 该模型具有 256k 的上下文窗口。
  • Hardware Efficiency: 该模型最少仅需四块 GPU 即可进行自托管。
  • Configurable Reasoning: 推理力度可根据每个请求进行配置,允许模型在快速聊天响应和复杂的智能体运行之间切换。
  • Vision Integration: 视觉编码器是从头开始训练的,以支持可变图像尺寸和长宽比。

基准测试

  • SWE-Bench Verified: Mistral Medium 3.5 得分为 77.6%,优于 Devstral 2 和 Qwen3.5 397B A17B。
  • τ³-Telecom: 该模型得分为 91.4,展示了强大的智能体能力。

Mistral Vibe 远程智能体

远程智能体将编码会话从本地笔记本电脑转移到云端,消除了开发者成为智能体执行每一步的瓶颈。这些智能体可以通过 Mistral Vibe CLI 和 Le Chat 使用。

异步编码工作流

  • Parallel Execution: 开发者可以生成多个云端智能体来并行运行任务。
  • Session Teleportation: 本地 CLI 会话可以“瞬间移动”到云端,并携带会话历史、任务状态和审批权限。
  • Integration: Vibe 集成了 GitHub (code 和 pull requests)、Linear 和 Jira (issues)、Sentry (incidents) 以及 Slack 和 Teams 等通信工具。
  • Sandbox Environment: 每个会话都在隔离的沙箱环境中运行,允许进行广泛的编辑和安装。
  • Outcome-Based Review: 智能体可以打开 GitHub pull requests 并在完成后通知用户,允许开发者审查最终结果,而不是逐个按键。

Le Chat Work Mode (预览)

Work mode 是 Le Chat 的智能体执行后端,由 Mistral Medium 3.5 提供支持,专为需要试错和长期持久性的复杂、多步骤项目而设计。

智能体能力

  • Cross-Tool Workflows: 智能体可以同时访问电子邮件、消息和日历,为会议做准备或处理收件箱。
  • Administrative Automation: 智能体可以根据讨论内容创建 Jira issues 或向 Slack 发送摘要。
  • Research and Synthesis: 智能体可以从网络、内部文档和连接的工具中综合信息,以生成结构化报告。
  • Operational Transparency: 每一个工具调用和思考逻辑对用户都是可见的。敏感任务(例如,发送消息或修改数据)需要基于权限的明确用户批准。

可用性与定价

Mistral Medium 3.5 是 Le Chat 中的新默认模型,并取代了 Vibe CLI 中的 Devstral 2。它适用于 Pro、Team 和 Enterprise 计划。

API 定价

  • Input Tokens: 每百万 token 消耗 $1.5。
  • Output Tokens: 每百万 token 消耗 $7.5。

部署选项

  • Hugging Face: 开源权重在修改后的 MIT 许可下提供。
  • NVIDIA: 可通过 build.nvidia.com 上的 GPU 加速端点使用,并作为可扩展的容器化推理微服务通过 NVIDIA NIM 提供。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch