自DeepSeek Moment以来的一年:中国开源AI生态的崛起

2025年1月,DeepSeek R1 的发布引发了“DeepSeek Moment”,催化了从闭源模型主导向中国蓬勃发展的有机开源 AI 生态系统的快速转变。这一转变导致中国模型在全球下载指标中占据主导地位,并推动西方 AI 社区寻求可商业部署的开放权重替代方案。

DeepSeek R1 作为技术和心理转折点

DeepSeek R1 通过降低三个关键障碍,从根本上改变了高级 AI 开发的开源格局:

  • 技术障碍: 通过共享推理路径和后训练方法,R1 将高级推理从封闭 API 的秘密转变为可下载的工程资产。这使得团队能够在不从头训练巨型模型的情况下提炼和微调推理能力,实际上将推理视为可重复使用的模块。
  • 采用障碍: R1 在 MIT 许可证下发布,使得修改和重新分发变得简单直接。这将行业焦点从理论基准分数转向实际部署、成本降低和系统集成。
  • 心理障碍: R1 的成功将中国 AI 社区内部的对话从“我们能做到吗?”转变为“我们该如何做得更好?”,为之前被视为追随者的生态系统提供了持续的全球认可时刻。

战略重新对齐与“AI+”战略

在 R1 发布之后,中国的 AI 战略从简单的模型对模型竞争转向构建全面的系统级能力。这一契合支持中国 2017 年的“AI+”战略,该战略强调将 AI 融入行业同时构建长期算力能力。

开源模型发布激增

来自 Hugging Face 的数据表明,2025 年全年,主要中国机构的开源发布数量大幅增加:

  • 百度: 从 2024 年在 Hugging Face 上的零次发布增加到 2025 年超过 100 次。
  • 字节跳动和腾讯: 他们的发布量增加了八到九倍。
  • 新进入者: 像 Moonshot AI 这样的组织发布了诸如 Kimi K2 之类的高性能模型,后者被描述为另一次“DeepSeek moment”。

生态系统主导地位

2025 年 2 月至 7 月间,中国公司的开源发布变得显著更加活跃。像 Zhipu AI(GLM)和阿里巴巴(Qwen)这样的领先企业不仅限于发布权重,还扩展到构建工程系统和生态系统接口。因此,过去一年内创建的中国模型的下载量已经超过了其他任何国家,包括美国。

全球接受度与地缘政治反应

尽管中国模型在全球范围内得到广泛采用——特别是由于成本低和多语言支持而在东南亚和非洲地区——但西方的反应呈两极分化。

对中国基础的依赖

许多全球研究者和初创公司现在默认使用中国开放权重模型。例如,总部位于美国的 Deep Cogito 在 2025 年 11 月发布了 Cogito v2.1,这是 DeepSeek-V3 的微调版本。

西方替代方案的推动

地缘政治压力推动西方组织寻求非中国模型以进行商业部署。这催生了一些主要倡议:

  • 美国: 诸如 OpenAI 的 gpt-oss、AI2 的 Olmo 和 Meta 的 Llama 4 等发布获得了高度关注。Reflection AI 实验室成立旨在构建前沿的美国开放权重模型,美国真正开放模型(ATOM)项目启动以重新夺回开放权重开发的领导地位。
  • 法国: Mistral 通过发布 Mistral Large 3 系列继续其开源轨迹。

这种全球环境催生了新的“开源热潮”,预计 2026 年美国和中国都将发布重大模型,以在架构趋势和硬件选择方面争夺领导地位。

Sources