Qwen3.8 發佈:2.4T 參數開源權重模型

Qwen3.8 發佈:2.4T 參數開源權重模型

Qwen3.8 為開源權重 AI 引入 2.4 兆參數

Alibaba 已宣布推出 Qwen3.8,這是一個擁有 2.4 兆參數的海量大型語言模型 (LLM)。該模型旨在與領先的前沿 AI 系統競爭,並將以開源權重模型的形式發佈,這標誌著開源 AI 可用性的規模有了顯著提升。

根據官方公告,Alibaba 將 Qwen3.8 定位為目前可用最強大的模型之一,並表示其「與領先的前沿 AI 模型相容,僅次於 Fable 5」。

可用性與存取方式

Qwen3.8 正分階段推出,在正式開源權重發佈之前,將先推出預覽版本。

預覽存取

  • Qwen3.8-Max-Preview: 目前可透過 Alibaba 的 Token Plan、Qoder 和 QoderWork 進行測試。
  • Qwen Chat: 使用者也可以透過 Qwen chat 介面免費存取該模型。

開源權重策略

雖然正式的開源權重發佈尚在進行中,但業界觀察家將此舉視為對中國 AI 實驗室之間日益激烈的競爭的戰略性回應。具體而言,此公告是在 Moonshot AI 揭曉 Kimi K3 之後發布的,Kimi K3 是一個擁有 2.8 兆參數的開源權重 LLM,預計將於 7 月 27 日在 Hugging Face 上發布。

技術影響與社群討論

Qwen3.8 的規模引發了關於硬體需求、效能與更廣泛的 AI 競爭格局的重大討論。

硬體與本地推論

鑑於 2.4T 參數規模,社群成員對 Alibaba 是否會發佈更小、經過蒸餾或量化後的模型版本表示了興趣。先前 Qwen 版本(例如 35B MoE 和 27B dense 模型)的使用者強調了在本地運行模型以處理敏感或個人數據,而不依賴 Claude 等雲端提供商的實用性。

效能與基準測試

雖然 Alibaba 聲稱該模型僅次於 Fable 5,但部分使用者對「基準測試公主化 (benchmark princessing)」表示了擔憂——即模型在標準測試中表現極佳,但在現實世界的穩健性可能不足。此外,也與其他中國模型進行了比較:

"DeepSeek V4 Pro 比 Qwen 3.7 Max 更強大、更快,且便宜得多。"

中國 AI 的戰略轉向

觀察家指出,中國實驗室的策略正在發生轉變,從「價值」模型(針對效率進行優化)轉向「智慧、龐大且緩慢」的模型。這種轉變的特徵是更高的 token 需求量與增加的計算需求,如最近 GLM 和 Kimi 的發佈版本所見。

競爭格局

Qwen3.8 進入了一個預期將有幾項重大更新的市場:

  • Moonshot AI: 即將發佈 Kimi K3 (2.8T 參數)。
  • DeepSeek: 預期將推出 DeepSeek 4 的「最終」版本,並預期其效能可能達到 Opus 4.8 的水準。
  • Anthropic: 透過 Fable 5 維持著被認為的「護城河」,而 Qwen3.8 明確旨在接近其水準。

Sources