DeepSeek時刻一年後:中國開源AI生態系統的崛起
2025年1月DeepSeek R1的發布引發了"DeepSeek時刻",加速了從閉源模型主導向中國蓬勃發展、有機的開源AI生態系統的轉變。此轉變導致中國模型在全球下載指標中佔據主導地位,並推動西方AI社區尋求可商業部署的開放權重替代方案。
DeepSeek R1 作為技術與心理的轉折點
DeepSeek R1 透過降低三個關鍵障礙,從根本上改變了開源AI格局,以促進高級AI開發:
- 技術障礙: 透過分享推理路徑和後訓練方法,R1 將先進推理從閉源API的秘密轉變為可下載的工程資產。這使團隊能夠在不從頭訓練巨型模型的情況下,提煉和微調推理能力,實際上將推理視為可重複使用的模組。
- 採用障礙: R1 在MIT許可證下發布,使修改和重新分發變得簡單直接。這將行業焦點從理論基準分數轉向實際部署、成本降低和系統整合。
- 心理障礙: R1 的成功將中國AI社區內部的對話從"我們能做到嗎?"轉變為"我們該如何做得更好?",為先前被視為追隨者的生態系統提供了持續的全球認可時刻。
戰略重新對齊與「AI+」策略
在R1發布之後,中國的AI策略從簡單的模型對模型競爭轉向建立全面的系統級能力。這一對齊支持中國2017年的「AI+」策略,該策略強調將AI融入產業同時建立長期的計算能力。
開源模型發布的爆炸式增長
來自Hugging Face的數據顯示,2025年全年中國主要組織的開源發布數量大幅增加:
- 百度: 從2024年在Hugging Face上的零發布增加到2025年超過100次。
- 字節跳動和騰訊: 他們的發布數量增加了八到九倍。
- 新進入者: 像Moonshot AI這樣的組織發布了高性能模型,例如Kimi K2,被描述為另一個"DeepSeek時刻"。
生態系統主導地位
2025年2月至7月期間,中國公司的開源發布變得顯著更加活躍。領先的參與者如智譜AI(GLM)和阿里巴巴(Qwen)擴展了僅發布權重的範圍,開始建立工程系統和生態系統介面。因此,過去一年內創建的中國模型下載量已超過任何其他國家,包括美國。
全球接受與地緣政治回應
儘管中國模型在全球範圍內獲得了廣泛採用——尤其是由於成本低廉和多語言支持而在東南亞和非洲地區——西方的反應卻呈現出兩極分化。
對中國基礎的依賴
許多全球研究人員和初創公司現在預設使用中國開放權重模型。例如,總部位於美國的Deep Cogito在2025年11月發布了Cogito v2.1,這是DeepSeek-V3的微調版本。
西方替代方案的推動
地緣政治壓力促使西方組織尋求非中國模型以進行商業部署。這激發了幾項主要倡議:
- 美國: 例如OpenAI的
gpt-oss、AI2的Olmo和Meta的Llama 4等發布獲得了高參與度。Reflection AI實驗室成立旨在建立前沿的美國開放權重模型,而美國真正開放模型(ATOM)項目則啟動,以重新奪回開放權重開發的領導地位。 - 法國: Mistral透過發布
Mistral Large 3系列繼續其開源軌跡。
這個全球環境催生了新的"開源熱潮",預計2026年將看到美國和中國的主要發布,因為他們在架構趨勢和硬體選擇上競爭領導地位。