DeepSeek-V3.1 发布说明

DeepSeek-V3.1 是一次模型更新,旨在通过引入混合推理模式和增强的工具使用能力,推动向「代理时代」的过渡。此次发布重点在于降低思考延迟、提升多步推理能力,并扩展思考模式与非思考模式下的上下文窗口。

混合推理:思考模式与非思考模式

DeepSeek-V3.1 实现了混合推理系统,允许用户在单一模型架构内切换两种不同的运行模式:

  • 思考模式(deepseek-reasoner): 此模式专为复杂推理优化。据报告,DeepSeek-V3.1-Think 的回答速度比之前的 DeepSeek-R1-0528 模型更快。
  • 非思考模式(deepseek-chat): 此模式提供标准的聊天交互,不包含扩展的推理过程。

两种模式均支持 128K 的上下文窗口。

代理能力与工具使用

DeepSeek-V3.1 在后训练阶段进行了专门优化,以增强工具使用和多步代理任务能力。这些升级带来了以下改进:

  • 基准测试表现提升: 模型在 SWE 和 Terminal-Bench 基准测试中表现更优。
  • 复杂搜索能力: 在复杂搜索任务中展现出更强的多步推理能力。
  • 效率提升: 模型在思考效率方面有显著提升。

为支持这些代理式工作流,Beta API 现已支持严格函数调用(Strict Function Calling)。

技术模型更新

DeepSeek-V3.1 基于 V3 架构,并进行了以下技术改进:

  • 持续预训练: V3.1 基础模型通过 8400 亿个 token 的持续预训练,进一步扩展了长上下文能力。
  • 分词器与模板: 分词器配置和聊天模板已更新。
  • 开源可用性: V3.1 基础模型和标准 V3.1 权重均已通过 Hugging Face 开源发布。

API 与集成详情

DeepSeek 已更新其 API 以适配新模型模式,并优化了集成选项:

  • API 端点: 使用 deepseek-chat 代表非思考模式,deepseek-reasoner 代表思考模式。
  • 兼容性: API 现在支持 Anthropic API 格式。
  • 基础设施: DeepSeek 已增加 API 资源,以确保更流畅的用户体验。

定价与时间表

新的定价结构以及停用非高峰时段折扣将于 2025 年 9 月 5 日 16:00 UTC 生效。在此日期之前,当前 API 定价政策保持不变。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch