DeepSeek-V3.2 and DeepSeek-V3.2-Speciale 发布

DeepSeek 发布了 DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale,这是一个专为智能体工作流(agentic workflows)设计的新推理优先系列模型。这些模型引入了将思考过程直接集成到工具使用中的能力,显著增强了模型在不同环境中处理复杂指令的能力。

世界领先的推理能力

DeepSeek-V3.2 和 V3.2-Speciale 为推理任务提供了不同的优化路径:

  • DeepSeek-V3.2: 定位为日常使用的平衡型模型,提供可与 GPT-5 级别性能相媲美的表现。
  • DeepSeek-V3.2-Speciale: 针对最大化推理能力而优化的模型,可与 Gemini-3.0-Pro 竞争。它在 IMO、CMO、ICPC World Finals 和 IOI 2025 中取得了金牌级别的成绩。

虽然 V3.2-Speciale 在复杂任务中占据主导地位,但它需要更高的 token 使用量,并且目前仅通过 API 提供,用于社区评估和研究目的。

工具使用中的思考与智能体训练

DeepSeek-V3.2 是该系列中第一个将“思考”直接集成到工具使用中的模型。这使得模型能够支持在思考模式和非思考模式下进行工具使用。

这种能力是由一种全新的大规模智能体训练数据合成方法驱动的。训练数据涵盖了超过 1,800 个环境和超过 85,000 条复杂指令,使模型能够在复杂的数字环境中充当更有效的智能体。

API 访问与可用性

可以通过以下渠道访问新模型:

  • DeepSeek-V3.2: 可在 App、Web 和 API 上使用,遵循与之前的 V3.2-Exp 版本相同的用法模式。
  • DeepSeek-V3.2-Speciale: 通过临时 API 端点 (https://api.deepseek.com/v3.2_speciale_expires_on_20251215) 提供。该模型可用至 2025 年 12 月 15 日 15:59 UTC。它与 V3.2 共享相同的定价,但不支持工具调用。

开源发布

两个模型都已在 Hugging Face 上开源发布:

有关架构和训练的技术细节可以在官方技术报告中找到。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch