Qwen3.8 發佈:2.4T 參數開源權重模型
Qwen3.8 發佈:2.4T 參數開源權重模型
Qwen3.8 為開源權重 AI 引入 2.4 兆參數
Alibaba 已宣布推出 Qwen3.8,這是一個擁有 2.4 兆參數的海量大型語言模型 (LLM)。該模型旨在與領先的前沿 AI 系統競爭,並將以開源權重模型的形式發佈,這標誌著開源 AI 可用性的規模有了顯著提升。
根據官方公告,Alibaba 將 Qwen3.8 定位為目前可用最強大的模型之一,並表示其「與領先的前沿 AI 模型相容,僅次於 Fable 5」。
可用性與存取方式
Qwen3.8 正分階段推出,在正式開源權重發佈之前,將先推出預覽版本。
預覽存取
- Qwen3.8-Max-Preview: 目前可透過 Alibaba 的 Token Plan、Qoder 和 QoderWork 進行測試。
- Qwen Chat: 使用者也可以透過 Qwen chat 介面免費存取該模型。
開源權重策略
雖然正式的開源權重發佈尚在進行中,但業界觀察家將此舉視為對中國 AI 實驗室之間日益激烈的競爭的戰略性回應。具體而言,此公告是在 Moonshot AI 揭曉 Kimi K3 之後發布的,Kimi K3 是一個擁有 2.8 兆參數的開源權重 LLM,預計將於 7 月 27 日在 Hugging Face 上發布。
技術影響與社群討論
Qwen3.8 的規模引發了關於硬體需求、效能與更廣泛的 AI 競爭格局的重大討論。
硬體與本地推論
鑑於 2.4T 參數規模,社群成員對 Alibaba 是否會發佈更小、經過蒸餾或量化後的模型版本表示了興趣。先前 Qwen 版本(例如 35B MoE 和 27B dense 模型)的使用者強調了在本地運行模型以處理敏感或個人數據,而不依賴 Claude 等雲端提供商的實用性。
效能與基準測試
雖然 Alibaba 聲稱該模型僅次於 Fable 5,但部分使用者對「基準測試公主化 (benchmark princessing)」表示了擔憂——即模型在標準測試中表現極佳,但在現實世界的穩健性可能不足。此外,也與其他中國模型進行了比較:
"DeepSeek V4 Pro 比 Qwen 3.7 Max 更強大、更快,且便宜得多。"
中國 AI 的戰略轉向
觀察家指出,中國實驗室的策略正在發生轉變,從「價值」模型(針對效率進行優化)轉向「智慧、龐大且緩慢」的模型。這種轉變的特徵是更高的 token 需求量與增加的計算需求,如最近 GLM 和 Kimi 的發佈版本所見。
競爭格局
Qwen3.8 進入了一個預期將有幾項重大更新的市場:
- Moonshot AI: 即將發佈 Kimi K3 (2.8T 參數)。
- DeepSeek: 預期將推出 DeepSeek 4 的「最終」版本,並預期其效能可能達到 Opus 4.8 的水準。
- Anthropic: 透過 Fable 5 維持著被認為的「護城河」,而 Qwen3.8 明確旨在接近其水準。