DeepSeek-R1 发布 – 开源模型性能比肩 OpenAI o1

TL;DR

DeepSeek 发布了 DeepSeek‑R1,这是一个开源模型,其在数学、代码和推理基准测试中的性能与 OpenAI o1 持平,并且该模型及其一系列蒸馏变体均已根据 MIT 许可证免费提供。

DeepSeek‑R1 性能声明

DeepSeek‑R1 被宣传为在数学、编程和逻辑推理任务中提供“与 OpenAI‑o1 持平的性能”。公告中包含了将 DeepSeek‑R1 与 OpenAI‑o1 进行比较的基准测试图表,表明在标准评估套件上具有相当的分数。

开源可用性与许可

  • 模型权重、训练代码和技术报告已公开发布。
  • DeepSeek‑R1 根据 MIT License 分发,允许不受限制的商业使用、重新分发和修改。
  • 明确允许使用 API 输出进行下游微调和模型蒸馏。

蒸馏模型家族

DeepSeek 也发布了六个源自 DeepSeek‑R1 的较小蒸馏模型:

  • 两个旗舰尺寸,32 B 和 70 B,据称可以匹配 OpenAI‑o1‑mini 的性能。
  • 所有六个蒸馏变体均完全开源,为资源受限的环境提供了更轻量级的替代方案。

技术亮点

  • 在大规模强化学习 (RL) 进行后训练 – DeepSeek‑R1 在主要预训练阶段之后应用 RL 以提高推理能力。
  • 数据效率 – 该模型在仅需极少量微调标注数据的情况下实现了显著的性能提升。
  • 基准测试重点 – 评估重点在于数学、代码生成和多步推理,在这些领域 DeepSeek‑R1 达到了与 OpenAI‑o1 的对等水平。
  • 完整的技术报告可在 GitHub 仓库中获取:https://github.com/deepseek-ai/DeepSeek-R1/blob/main/DeepSeek_R1.pdf。

API 访问与定价

  • 可以通过设置 model=deepseek-reasoner 来调用 DeepSeek API。
  • 定价结构(截至公告发布时):
    • 每百万输入 token 0.14 美元(发生缓存命中时)。
    • 每百万输入 token 0.55 美元(发生缓存未命中时)。
    • 每百万输出 token 2.19 美元
  • 详细的使用说明在 API 指南中提供:https://api-docs.deepseek.com/guides/thinking_mode。

社区影响力

  • 通过在宽松的许可证下发布旗舰模型和蒸馏变体,DeepSeek 旨在赋能开源 AI 社区并降低构建先进推理系统的门槛。
  • 开源许可和商业友好型条款被定位为直接挑战专有产品,鼓励更广泛的实验和采用。

视觉摘要

公告中包含了若干说明性图像:

  • DeepSeek‑R1 运行时的动画演示。
  • 将 DeepSeek‑R1 与 OpenAI‑o1 进行比较的基准测试图表。
  • 总结蒸馏模型性能的表格。
  • 将 DeepSeek‑R1 成本与竞争服务进行对比的定价比较图表。

所有声明均仅基于 DeepSeek 于 2025‑01‑20 发布的正规公告。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch