Hugging Face 開源狀況:2026 年春季
開源 AI 生態系統經歷了快速成長,用戶、模型與資料集倉庫的數量幾乎翻倍。截至 2025 年,Hugging Face 的使用者已增至 1300 萬人,公開模型超過 200 萬個,公開資料集超過 50 萬個,顯示出從被動消費轉向透過打造微調模型、適配器與基準測試的主動參與。
生態系統集中度與企業採用
儘管整體成長,生態系統仍高度集中:0.01% 的模型(下載量最高的前 200 個)佔所有下載的 49.6%,而約有一半的模型下載量不足 200 次。
企業對開源的採用正持續增加,超過 30% 的《財富 500 強》公司現在在 Hugging Face 上擁有已驗證的帳號。大型科技公司的投資顯而易見,NVIDIA 成為最強大的貢獻者。報告指出,開放產物所創造的下游價值常常超過生產成本,為組織提供較高的彈性與較低的成本,相較於完全封閉的系統。
地理變化與中國 AI 的崛起
中國在每月及總體模型下載量上已超過美國。過去一年,中國模型佔所有下載的 41%。此變化因 DeepSeek 於 2025 年 1 月釋出的 R1 模型迅速走紅而加速,導致包括百度(從 2024 年零發布增至 2025 年超過 100 次)、字節跳動與騰訊等組織的開源釋出激增。
儘管美國與西歐仍透過 Meta、Google 等大型實驗室持續貢獻,但中國組織的倉庫成長軌跡顯著更陡。另有個人與非隸屬開發者的下載份額自 2022 年的 17% 上升至 39%,他們常聚焦於基礎模型的量化與適配。
國家主權與 AI 計畫
開放權重模型日益被視為國家主權的工具,使政府能在本土硬體上部署 AI,並在本地資料上微調系統。
- South Korea: 在 2025 年中期啟動「國家主權 AI 計畫」,指定包括 LG AI Research、SK Telecom、Naver Cloud、NC AI 與 Upstage 在內的國家冠軍企業。
- Europe: 瑞士的 Swiss AI 計畫以及各項歐盟資助的專案皆以類似目標為優先,英國則遵循「公帑公碼」原則。
模型人氣與技術趨勢
人氣轉變
社群關注已從以美國為主的格局(Meta 的 Llama 系列)轉向國際混合,中國的 DeepSeek‑R1 目前位居最受喜愛模型之首。
派生模型
阿里巴巴的 Qwen 系列獲得大量採用,派生模型超過 113,000 個(若計入所有標記 Qwen 的模型則超過 200,000 個),超過 Google 與 Meta 合計的派生模型數量。
可及性與模型規模
由於成本與延遲的限制,小型模型的下載與部署率遠高於大型系統。雖然下載模型的平均規模從 2023 年的 8.27 億參數升至 2025 年的 208 億參數(受 MoE 與量化驅動),但中位數規模僅從 3.26 億參數略增至 4.06 億參數。
新興子社群
機器人
機器人是 Hugging Face 上增長最快的子社群。機器人資料集從 2024 年的 1,145 個增至 2025 年的 26,991 個,成為 Hub 上最大的資料集類別,超過文字生成。重要發展包括 LeRobot 函式庫與 Learning to Drive(L2D)多模態資料集。
科學 AI
開放模型日益應用於蛋白質摺疊、分子動力學與藥物發現。雖然前沿 AI 公司擁有專門的科學團隊,但目前社群的主要焦點仍在文獻探索與大規模跨領域協調。
計算與硬體最佳化
開發正轉向跨硬體相容性。雖然 NVIDIA GPU 仍占主導,對 AMD 硬體的支援亦在擴大,且 Hugging Face 於 2025 年推出 Kernel Hub,以優化 NVIDIA 與 AMD 的核心。與此同時,中國模型明確支援本土晶片架構,以降低對外國雲端基礎設施的依賴。