DeepSeek-V4 Preview Release
DeepSeek 发布了 DeepSeek-V4 Preview,这是一个开源模型系列,具有标准的 1M token 上下文长度和高效架构。此次发布引入了两个不同的模型变体:DeepSeek-V4-Pro 和 DeepSeek-V4-Flash,旨在平衡高端推理能力和高性价比性能。
Model Variants and Specifications
DeepSeek-V4 引入了两个针对不同性能和效率需求定制的模型:
- DeepSeek-V4-Pro: 一个高容量模型,具有 1.6T 总参数和 49B 激活参数。其设计旨在在性能上与顶尖的闭源模型相媲美。
- DeepSeek-V4-Flash: 一个更小、更高效的模型,具有 284B 总参数和 13B 激活参数,针对速度和成本效益进行了优化。
Technical Capabilities and Benchmarks
DeepSeek-V4-Pro 在多个关键领域被定位为最先进的开源模型:
- Agentic Coding: 该模型在 agentic coding 基准测试中实现了最先进的 (SOTA) 性能。
- World Knowledge: DeepSeek-V4-Pro 在世界知识方面领先于所有当前的开源模型,仅次于 Gemini-3.1-Pro。
- Reasoning: 该模型在 Math、STEM 和 Coding 方面优于所有当前的开源模型,足以与顶尖的闭源替代方案相媲美。
DeepSeek-V4-Flash 提供了接近 Pro 版本推理能力的推理能力,并且在简单的 agent 任务上与 V4-Pro 表现相当,同时提供更快的响应速度和更低的 API 价格。
Structural Innovation and Context Efficiency
DeepSeek-V4 实现了创新的注意力机制,以在所有官方服务中将 1M token 上下文窗口作为默认配置。这种效率是通过以下方式实现的:
- Token-wise compression
- DSA (DeepSeek Sparse Attention)
这些创新降低了处理长上下文窗口相关的计算和内存成本,为该系列建立了 1M 上下文标准。
Agent Integration and Optimizations
DeepSeek-V4 针对 agentic workflows 进行了优化,并且已经与 Claude Code、OpenClaw 和 OpenCode 等领先的 AI agent 进行了集成。该模型也被 DeepSeek 内部用于 agentic coding 任务。
API Availability and Migration
DeepSeek-V4 模型现已通过 API 可用,支持 OpenAI ChatCompletions 和 Anthropic APIs。用户可以通过将模型名称更新为 deepseek-v4-pro 或 deepseek-v4-flash 并保持相同的 base_url 来进行迁移。
两个模型都支持双模式:Thinking 和 Non-Thinking。
Important Migration Note: deepseek-chat 和 deepseek-reasoner 模型将在 2026 年 7 月 24 日 15:59 UTC 之后完全退役并无法访问。目前,这些遗留模型分别在 non-thinking 和 thinking 模式下路由到 deepseek-v4-flash。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch