DeepSeek-V3.1 發佈說明
DeepSeek-V3.1 是一次模型更新,旨在透過引入混合推理模式和增強的工具使用能力,向「代理時代 (agent era)」邁進。本次發佈的重點在於降低思考延遲、改進多步推理,並為思考與非思考模式擴展上下文窗口。
混合推理:思考與非思考模式
DeepSeek-V3.1 實作了一套混合推理系統,允許使用者在單一模型架構中切換兩種不同的操作模式:
- 思考模式 (deepseek-reasoner): 此模式針對複雜推理進行了優化。據報導,DeepSeek-V3.1-Think 的回答速度比之前的 DeepSeek-R1-0528 模型更快。
- 非思考模式 (deepseek-chat): 此模式提供標準的聊天互動,無需經過延伸的推理過程。
兩種模式皆支援 128K 上下文窗口。
代理能力與工具使用
DeepSeek-V3.1 具備專門針對提升工具使用和多步代理任務而進行的訓練後增強功能。這些升級帶來了:
- 改進的基準測試: 模型在 SWE 和 Terminal-Bench 上表現出更好的結果。
- 複雜搜尋: 對於複雜的搜尋任務,具備更強的多步推理能力。
- 效率: 模型在思考效率方面展現了顯著的提升。
為了支援這些代理工作流,Beta API 現在支援 Strict Function Calling。
技術模型更新
DeepSeek-V3.1 是基於 V3 架構構建,並進行了以下技術修改:
- 持續預訓練: V3.1 Base 模型透過 840B tokens 進行了持續預訓練,以擴展長上下文能力。
- Tokenizer 與模板: Tokenizer 配置和聊天模板已更新。
- 開源可用性: V3.1 Base 和標準 V3.1 權重皆可透過 Hugging Face 取得。
API 與整合細節
DeepSeek 已更新其 API 以配合新的模型模式,並更新了整合選項:
- API 端點:
deepseek-chat用於非思考模式,deepseek-reasoner用於思考模式。 - 相容性: API 現在支援 Anthropic API 格式。
- 基礎設施: DeepSeek 已增加 API 資源以確保更流暢的使用者體驗。
定價與時程
新的定價結構和非尖峰時段折扣的結束將於 2025 年 9 月 5 日 16:00 UTC 生效。在此日期之前,目前的 API 定價將繼續有效。
Sources
相關
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch