DeepSeek-V4 Preview Release

DeepSeek 发布了 DeepSeek-V4 Preview,这是一个开源模型系列,具有标准的 1M token 上下文长度和高效架构。此次发布引入了两个不同的模型变体:DeepSeek-V4-Pro 和 DeepSeek-V4-Flash,旨在平衡高端推理能力和高性价比性能。

Model Variants and Specifications

DeepSeek-V4 引入了两个针对不同性能和效率需求定制的模型:

  • DeepSeek-V4-Pro: 一个高容量模型,具有 1.6T 总参数和 49B 激活参数。其设计旨在在性能上与顶尖的闭源模型相媲美。
  • DeepSeek-V4-Flash: 一个更小、更高效的模型,具有 284B 总参数和 13B 激活参数,针对速度和成本效益进行了优化。

Technical Capabilities and Benchmarks

DeepSeek-V4-Pro 在多个关键领域被定位为最先进的开源模型:

  • Agentic Coding: 该模型在 agentic coding 基准测试中实现了最先进的 (SOTA) 性能。
  • World Knowledge: DeepSeek-V4-Pro 在世界知识方面领先于所有当前的开源模型,仅次于 Gemini-3.1-Pro。
  • Reasoning: 该模型在 Math、STEM 和 Coding 方面优于所有当前的开源模型,足以与顶尖的闭源替代方案相媲美。

DeepSeek-V4-Flash 提供了接近 Pro 版本推理能力的推理能力,并且在简单的 agent 任务上与 V4-Pro 表现相当,同时提供更快的响应速度和更低的 API 价格。

Structural Innovation and Context Efficiency

DeepSeek-V4 实现了创新的注意力机制,以在所有官方服务中将 1M token 上下文窗口作为默认配置。这种效率是通过以下方式实现的:

  • Token-wise compression
  • DSA (DeepSeek Sparse Attention)

这些创新降低了处理长上下文窗口相关的计算和内存成本,为该系列建立了 1M 上下文标准。

Agent Integration and Optimizations

DeepSeek-V4 针对 agentic workflows 进行了优化,并且已经与 Claude Code、OpenClaw 和 OpenCode 等领先的 AI agent 进行了集成。该模型也被 DeepSeek 内部用于 agentic coding 任务。

API Availability and Migration

DeepSeek-V4 模型现已通过 API 可用,支持 OpenAI ChatCompletions 和 Anthropic APIs。用户可以通过将模型名称更新为 deepseek-v4-prodeepseek-v4-flash 并保持相同的 base_url 来进行迁移。

两个模型都支持双模式:ThinkingNon-Thinking

Important Migration Note: deepseek-chatdeepseek-reasoner 模型将在 2026 年 7 月 24 日 15:59 UTC 之后完全退役并无法访问。目前,这些遗留模型分别在 non-thinking 和 thinking 模式下路由到 deepseek-v4-flash

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch