✷ 封存 · 11 個實驗室 · 12 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
DeepSeek-V4.1-Flash 發布說明
DeepSeek 發布了 DeepSeek-V4.1-Flash,這是一款具備非對稱因果編碼器-解碼器架構的多模態 MoE 模型,在性能與成本上均超越 DeepSeek-V4-Pro。
DeepSeek-V4-Flash-Vision-Exp 發布說明
DeepSeek 已發布 DeepSeek-V4-Flash-Vision-Exp,這是一款實驗性多模態模型,可彌補快速文字處理與高階視覺理解之間的差距,適用於代理工作流程。
DeepSeek-V4-Pro GA Release
DeepSeek 已發布 DeepSeek-V4-Pro,其特色包括增強的代理能力、靈活的推理強度設定,以及對 OpenAI Responses API 的原生支持。
DeepSeek-V4 Preview Release
DeepSeek 已發佈開源的 DeepSeek-V4 preview,推出了兩種模型變體——Pro 與 Flash——具備 1M token 上下文窗口與尖端的 agentic coding 能力。
DeepSeek-V3.2 and DeepSeek-V3.2-Speciale 發佈
DeepSeek 發佈了 DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale,這是專為代理設計的推理優先模型,引入了工具使用中整合思考的能力,並在競賽程式設計和數學領域展現了金牌級別的性能。
DeepSeek-V3.2-Exp 發佈說明
DeepSeek 已發佈 DeepSeek-V3.2-Exp,這是一款具備 DeepSeek Sparse Attention (DSA) 技術的實驗性模型,旨在提升長文本上下文效率並將 API 價格降低超過 50%。
DeepSeek-V3.1-Terminus 發佈說明
DeepSeek 發佈了 DeepSeek-V3.1-Terminus,這是 V3.1 的更新版本,改進了語言一致性並增強了 Code Agent 與 Search Agent 的效能。
DeepSeek-V3.1 發佈說明
DeepSeek-V3.1 引入了混合推理模式、改進的代理能力,以及用於擴展長上下文的持續預訓練,標誌著向以代理為中心的 AI 邁進了一步。
DeepSeek-R1-0528 發佈通知
DeepSeek 發佈了 DeepSeek-R1-0528,這是 R1 模型的一個更新版本,具有提升的基準測試性能、減少的幻覺,以及對 JSON 輸出與函數調用 (function calling) 的支持。
DeepSeek-V3-0324 發布說明
DeepSeek 已發布 DeepSeek-V3-0324,具備改進的推理、前端開發與工具使用能力,現已開放於 MIT 授權下使用。
DeepSeek-R1 發佈 – 開源模型性能比肩 OpenAI o1
DeepSeek 發佈了開源的 DeepSeek‑R1 模型,該模型在數學、程式碼和推理任務上比肩 OpenAI o1,並根據 MIT 授權條款發佈,可免費進行商業使用。
DeepSeek App 發佈
DeepSeek 已推出一款由 DeepSeek-V3 驅動的免費、跨平台行動應用程式,具備網頁搜尋與 Deep-Think 模式。