全球开源 AI 生态系统的未来:从 DeepSeek 到 AI+

开源已成为中国 AI 组织实现大规模部署和集成的主流且受欢迎的方式。通过公开共享模型、研究论文和部署基础设施,这些组织利用组织内部和全球社区的收益,将 AI 融入工业流程和工作流。

中国有机开源 AI 生态系统

中国正在形成一个有机的开源 AI 生态系统,其特征是协作式的方式,已有的科技巨头、初创公司以及面向应用的企业共同向共享的成果池贡献。此协作具有全球影响,DeepSeek 与 Qwen 分别在 Hugging Face 上位列最受关注和第四受关注的组织。

已有玩家的战略转变

  • Alibaba: 将 Qwen 定位为一个覆盖多种规模和模态的模型家族,而非单一旗舰模型。到 2025 年中期,Qwen 成为 Hugging Face 上衍生模型最多的模型,超过 113,000 个模型以其为基础,超过 200,000 个仓库打上标签——超越 Meta 的 Llama(27k)和 DeepSeek(6k)。
  • Tencent: 从将外部开源模型(如 DeepSeek R1)集成到消费产品,转向发布自有能力。自 2025 年 5 月起,腾讯在 Tencent HY(原鸿元)品牌下加速开放发布,重点聚焦视觉、视频和 3D。
  • ByteDance: 采用“AI 应用工厂”模式,选择性开源高价值组件。关键贡献包括用于多模态 UI 理解的 UI-TARS-1.5、用于数据中心代码建模的 Seed-Coder,以及用于推理评估的 SuperGPQA 数据集。其 AI 应用 Doubao 在 2025 年 12 月突破 1 亿日活用户(DAU)。
  • Baidu: 从优先闭源模型转向通过免费访问和开源发布(如 Ernie 4.5 系列)重新进入生态系统。百度还在投资其开源框架 PaddlePaddle 以及 AI 芯片 Kunlunxin(于 2026 年 1 月 1 日上市)。

初创企业与应用层的动能

  • AI Startups: Moonshot(Kimi K2)、Z.ai(GLM-4.5)和 MiniMax(MiniMax M2)发布了先进的开源模型,获得 AI-World 里程碑排名。Z.ai 与 MiniMax 在 2025 年底宣布 IPO 计划。
  • Application Companies: 小红书、哔哩哔哩、小米和美团等公司已开始训练并发布内部模型,以围绕特定业务需求调优 AI,而非依赖外部供应商。
  • Research Institutions: BAAI 与上海 AI Lab 正转向通过开发工具链、评估系统(OpenCompass)和数据平台(OpenDataLab、FlagOpen)来强化生态系统基础。

未来的基石:基础设施与 “AI+”

中国的 AI 生态系统正从孤立的突破转向能够在真实场景中执行的系统。这得益于长期的国家基础设施战略以及政策重点的转变。

计算与能源基础设施

该生态系统基于“东数西算”战略构建,已设立 8 大计算中心和 10 个数据中心集群。至 2025 年,中国的总计算能力约为 1,590 EFLOPS。专用于 AI 训练和部署的智能计算能力预计同比增长约 43%。此外,数据中心的平均电源使用效率(PUE)已降至约 1.46。

“AI+”行动计划

2017 年的《新一代人工智能发展规划》侧重于基础设施,而 2025 年 8 月的《AI+行动计划》则将重点转向大规模部署和深度融合。该战略优先将 AI 嵌入工业流程、代理和工作流,而非追求通用人工智能(AGI)。DeepSeek R1 的发布起到了催化剂作用,激活了已有的计算、能源和数据基础设施,使开源模型成为系统设计的默认假设。

结论:可行的可扩展交付路径

2025 年中国的 AI 发展轨迹以工程效率和可扩展交付为定义,而非追求极致性能。资源限制重塑了发展路径,形成了一个有机结构的生态系统,模型被视为大型工程系统中可复用、可组合的组件。

Sources