DeepSeek-R1 發佈 – 開源模型性能比肩 OpenAI o1

TL;DR

DeepSeek 發佈了 DeepSeek‑R1,這是一款開源模型,其在數學、程式碼和推理基準測試中的性能與 OpenAI o1 持平,並且該模型及其一系列蒸餾變體均已根據 MIT 授權條款免費提供。

DeepSeek‑R1 性能宣稱

DeepSeek‑R1 被宣傳為在數學、程式設計和邏輯推理任務中提供「與 OpenAI‑o1 持平的性能」。該公告包含了將 DeepSeek‑R1 與 OpenAI‑o1 進行比較的基準測試圖表,顯示在標準評估套件上的得分相當。

開源可用性與授權

  • 模型權重、訓練程式碼和技術報告已公開發佈。
  • DeepSeek‑R1 是根據 MIT License 分發的,允許不受限制的商業使用、重新分發和修改。
  • API 輸出被明確允許用於下游微調和模型蒸餾。

蒸餾模型系列

DeepSeek 還發佈了六個源自 DeepSeek‑R1 的較小蒸餾模型:

  • 兩個旗艦尺寸,32 B 和 70 B,據稱可比肩 OpenAI‑o1‑mini 的性能。
  • 所有六個蒸餾變體均為完全開源,為資源受限的環境提供更輕量級的替代方案。

技術亮點

  • 在大規模強化學習 (RL) 進行後訓練 – DeepSeek‑R1 在主要預訓練階段之後應用 RL 以提高推理能力。
  • 數據效率 – 該模型在僅需極少微調標籤數據的情況下實現了顯著的性能提升。
  • 基準測試重點 – 評估重點在於數學、程式碼生成和多步推理,在這些領域 DeepSeek‑R1 達到了與 OpenAI‑o1 的同等水平。
  • 完整的技術報告可在 GitHub 儲存庫中查看:https://github.com/deepseek-ai/DeepSeek-R1/blob/main/DeepSeek_R1.pdf。

API 存取與定價

  • 可以透過設定 model=deepseek-reasoner 來透過 DeepSeek API 調用該模型。
  • 定價結構(截至公告發佈時):
    • 每百萬個輸入 token 0.14 美元(當發生快取命中時)。
    • 每百萬個輸入 token 0.55 美元(當發生快取未命中時)。
    • 每百萬個輸出 token 2.19 美元
  • 詳細的使用說明請參閱 API 指南:https://api-docs.deepseek.com/guides/thinking_mode。

社群對影響

  • 透過在寬鬆的授權條款下發佈旗艦模型和蒸餾變體,DeepSeek 的目標是賦能開源 AI 社群,並降低構建先進推理系統的門檻。
  • 開源授權和商業友好的條款被定位為對專有產品的直接挑戰,鼓勵更廣泛的實驗和採用。

視覺摘要

該公告包含了幾張說明性圖片:

  • DeepSeek‑R1 運作中的動畫演示。
  • 將 DeepSeek‑R1 與 OpenAI‑o1 進行比較的基準測試圖表。
  • 總結蒸餾模型性能的表格。
  • 將 DeepSeek‑R1 成本與競爭服務進行比較的定價對比圖表。

所有聲明僅基於 DeepSeek 於 2025‑01‑20 發佈的官方發佈內容。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch