DeepSeek-V3.1 发布说明
DeepSeek-V3.1 是一次模型更新,旨在通过引入混合推理模式和增强的工具使用能力,推动向「代理时代」的过渡。此次发布重点在于降低思考延迟、提升多步推理能力,并扩展思考模式与非思考模式下的上下文窗口。
混合推理:思考模式与非思考模式
DeepSeek-V3.1 实现了混合推理系统,允许用户在单一模型架构内切换两种不同的运行模式:
- 思考模式(deepseek-reasoner): 此模式专为复杂推理优化。据报告,DeepSeek-V3.1-Think 的回答速度比之前的 DeepSeek-R1-0528 模型更快。
- 非思考模式(deepseek-chat): 此模式提供标准的聊天交互,不包含扩展的推理过程。
两种模式均支持 128K 的上下文窗口。
代理能力与工具使用
DeepSeek-V3.1 在后训练阶段进行了专门优化,以增强工具使用和多步代理任务能力。这些升级带来了以下改进:
- 基准测试表现提升: 模型在 SWE 和 Terminal-Bench 基准测试中表现更优。
- 复杂搜索能力: 在复杂搜索任务中展现出更强的多步推理能力。
- 效率提升: 模型在思考效率方面有显著提升。
为支持这些代理式工作流,Beta API 现已支持严格函数调用(Strict Function Calling)。
技术模型更新
DeepSeek-V3.1 基于 V3 架构,并进行了以下技术改进:
- 持续预训练: V3.1 基础模型通过 8400 亿个 token 的持续预训练,进一步扩展了长上下文能力。
- 分词器与模板: 分词器配置和聊天模板已更新。
- 开源可用性: V3.1 基础模型和标准 V3.1 权重均已通过 Hugging Face 开源发布。
API 与集成详情
DeepSeek 已更新其 API 以适配新模型模式,并优化了集成选项:
- API 端点: 使用
deepseek-chat代表非思考模式,deepseek-reasoner代表思考模式。 - 兼容性: API 现在支持 Anthropic API 格式。
- 基础设施: DeepSeek 已增加 API 资源,以确保更流畅的用户体验。
定价与时间表
新的定价结构以及停用非高峰时段折扣将于 2025 年 9 月 5 日 16:00 UTC 生效。在此日期之前,当前 API 定价政策保持不变。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch