DeepSeek-R1 發佈 – 開源模型性能比肩 OpenAI o1
TL;DR
DeepSeek 發佈了 DeepSeek‑R1,這是一款開源模型,其在數學、程式碼和推理基準測試中的性能與 OpenAI o1 持平,並且該模型及其一系列蒸餾變體均已根據 MIT 授權條款免費提供。
DeepSeek‑R1 性能宣稱
DeepSeek‑R1 被宣傳為在數學、程式設計和邏輯推理任務中提供「與 OpenAI‑o1 持平的性能」。該公告包含了將 DeepSeek‑R1 與 OpenAI‑o1 進行比較的基準測試圖表,顯示在標準評估套件上的得分相當。
開源可用性與授權
- 模型權重、訓練程式碼和技術報告已公開發佈。
- DeepSeek‑R1 是根據 MIT License 分發的,允許不受限制的商業使用、重新分發和修改。
- API 輸出被明確允許用於下游微調和模型蒸餾。
蒸餾模型系列
DeepSeek 還發佈了六個源自 DeepSeek‑R1 的較小蒸餾模型:
- 兩個旗艦尺寸,32 B 和 70 B,據稱可比肩 OpenAI‑o1‑mini 的性能。
- 所有六個蒸餾變體均為完全開源,為資源受限的環境提供更輕量級的替代方案。
技術亮點
- 在大規模強化學習 (RL) 進行後訓練 – DeepSeek‑R1 在主要預訓練階段之後應用 RL 以提高推理能力。
- 數據效率 – 該模型在僅需極少微調標籤數據的情況下實現了顯著的性能提升。
- 基準測試重點 – 評估重點在於數學、程式碼生成和多步推理,在這些領域 DeepSeek‑R1 達到了與 OpenAI‑o1 的同等水平。
- 完整的技術報告可在 GitHub 儲存庫中查看:https://github.com/deepseek-ai/DeepSeek-R1/blob/main/DeepSeek_R1.pdf。
API 存取與定價
- 可以透過設定
model=deepseek-reasoner來透過 DeepSeek API 調用該模型。 - 定價結構(截至公告發佈時):
- 每百萬個輸入 token 0.14 美元(當發生快取命中時)。
- 每百萬個輸入 token 0.55 美元(當發生快取未命中時)。
- 每百萬個輸出 token 2.19 美元。
- 詳細的使用說明請參閱 API 指南:https://api-docs.deepseek.com/guides/thinking_mode。
社群對影響
- 透過在寬鬆的授權條款下發佈旗艦模型和蒸餾變體,DeepSeek 的目標是賦能開源 AI 社群,並降低構建先進推理系統的門檻。
- 開源授權和商業友好的條款被定位為對專有產品的直接挑戰,鼓勵更廣泛的實驗和採用。
視覺摘要
該公告包含了幾張說明性圖片:
- DeepSeek‑R1 運作中的動畫演示。
- 將 DeepSeek‑R1 與 OpenAI‑o1 進行比較的基準測試圖表。
- 總結蒸餾模型性能的表格。
- 將 DeepSeek‑R1 成本與競爭服務進行比較的定價對比圖表。
所有聲明僅基於 DeepSeek 於 2025‑01‑20 發佈的官方發佈內容。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch