01

Qwen3.8-Max 發佈說明 / 更新內容

Qwen 已發佈 Qwen3.8-Max,這是一個 2.4 兆參數的模型,專為自主編碼、專業工作流與長週期任務而設計,開源權重將於下週抵達。

02

Qwen-Image-3.0 版本說明

Qwen-Image-3.0 是第三代圖像生成模型,聚焦於真實感與實用性,支援 4.5k 令牌輸入以處理複雜版面、10px 小字渲染,並原生支援 12 種語言。

03

Qwen-AgentWorld 發布:七個領域的語言世界模型及其對通用代理的影響

Qwen 推出 Qwen‑AgentWorld,一個模擬七種代理環境的語言世界模型,透過可控模擬與統一的下一狀態預測提升通用代理的效能。

04

Qwen 機器人套件:統一的導航、操作與世界建模基礎模型

Qwen 推出了 Qwen‑Robot 套件——三個基礎模型(RobotNav、RobotManip、RobotWorld),將語言轉換為導航、操作和世界預測動作,使得在數十種形態下的統一代理機器人得以實現。

05

Qwen-RobotWorld:無限世界給具身代理人

Qwen-RobotWorld 是一個統一的世界模型,使用自然語言作為通用的動作介面,以實現跨情境的物理泛化,涵蓋 20 多種機器人形態。

06

Qwen-RobotManip:對齊解鎖機器人操作基礎模型的規模化

Qwen-RobotManip 是一個視覺-語言-動作(VLA)基礎模型,透過統一的對齊框架與人類到機器人的資料合成管線,實現了在多樣化機器人形態與分布外任務上的最先進泛化能力。

07

Qwen-RobotNav:可擴展的代理系統導航模型

Qwen-RobotNav 是基於 Qwen3-VL 的統一導航模型,透過將視覺上下文視為可在推論時控制的介面,實現在五個導航領域的最先進表現。

08

Qwen3.7-Plus 版本說明 / 新功能

Qwen3.7-Plus 是一個多模態代理模型,將視覺與語言統合,能在 GUI 與 CLI 環境中運作,以應對複雜的軟體工程與生產力自動化任務。

09

Qwen-VLA:統一視覺-語言-行動建模以實現具身智慧

Qwen-VLA 是一個通用的視覺-語言-行動模型,將機器人操作、視覺-語言導航以及跨具身控制統一於單一的通用策略模型中。

10

Qwen3.7-Max 代理模型發布

Qwen 發布了 Qwen3.7-Max,一款專注於代理的基礎模型,擅長程式碼編寫、辦公自動化以及超長時程自主任務,現已透過阿里雲 Model Studio 提供。

11

Qwen3.5-LiveTranslate-Flash 版本說明

Qwen3.5-LiveTranslate-Flash 是基於 Qwen3.5-Omni 的同聲傳譯模型,提供即時、多模態的翻譯,支援 60 種語言,具備超低延遲與語音克隆功能。

12

Qwen-Scope 可解釋性工具包發布

Qwen 發布了 Qwen-Scope,一款使用稀疏自編碼器(SAE)將 Qwen3 與 Qwen3.5 模型的隱藏表示分解為可解釋特徵,以進行模型優化的可解釋性工具包。

13

FlashQLA:適用於 CP / 反向傳播的融合線性注意力核心(針對 GDN)

Qwen 已開源 FlashQLA,這是一個基於 TileLang 的高效能線性注意力核心庫,能在 NVIDIA Hopper GPU 上為門控增量網路(GDN)層提供 2‑3 倍的前向與 2 倍的反向加速。

14

Qwen3.6-27B 版本說明 / 新功能

Qwen 已發布 Qwen3.6-27B,一款密集的 270 億參數多模態模型,在所有主要代理式編程基準測試上超越了更大的 Qwen3.5-397B-A17B。

15

Qwen3.6-Max-Preview 版本說明 / 新功能

Qwen3.6-Max-Preview 是 Qwen 推出的專有預覽模型,在代理式程式編寫、世界知識與指令遵循方面較 Qwen3.6-Plus 有所提升。

16

Qwen3.6-35B-A3B 發布說明

Qwen 已發布 Qwen3.6-35B-A3B,這是一個開源的混合專家模型,擁有 350 億總參數與 30 億活躍參數,在代理式編碼與多模態推理方面可與更大型的密集模型相抗衡。

17

沙達根中央市場招牌垂直文字(2024 年)– “2006”

2024 年沙達根中央市場主招牌右側的垂直文字為「2006」。

18

Qwen3.5-Omni 版本說明

Qwen 宣佈了 Qwen3.5-Omni,一款能處理文字、圖像、音訊與影片的全新全模態大型語言模型,支援 256k 上下文、113 種語言的語音辨識、36 種語言的語音合成,並新增即時功能,如語意中斷、網路搜尋、語音控制與語音克隆。

19

Qwen3.5-Max-Preview 在 LMSys Arena 的發佈

Qwen 已將 Qwen3.5-Max-Preview 部署至 LMSys Arena,供社群評估,並於兩週內完成正式發布。

20

Qwen 3.5‑397B‑A17B 釋出:混合線性注意力 MoE 模型,具備 1 M 令牌上下文與最先進的多模態效能

Qwen 3.5‑397B‑A17B 是一個 397 0 億參數的多模態模型,每個令牌僅啟用 170 億參數,在語言、程式碼、推理與視覺任務上達到最先進的表現,同時比前代快至 19 倍。

21

Qwen-Image-2.0 發布:專業資訊圖表與寫實渲染

Qwen-Image-2.0 是一個統一的圖像生成與編輯模型,支援 1k 令牌指令以製作專業資訊圖表,並具備原生 2K 解析度以實現高保真寫實渲染。

22

Qwen3-Coder-Next 釋出:高效能代理式編碼模型

Qwen3-Coder-Next 是一個基於混合注意力與 MoE 架構的開放權重模型,在 SWE-Bench Verified 上達到超過 70% 的成功率,提供與規模大 10‑20 倍模型相當的效能。

23

Qwen3-ASR 與 Qwen3-ForcedAligner 發布

Qwen 已開源 Qwen3‑ASR(1.7B 與 0.6B)以及 Qwen3‑ForcedAligner‑0.6B,提供最先進的多語言語音辨識與非自回歸時間戳預測,並採用 Apache 2.0 授權。

24

Qwen3-Max-Thinking 發布說明

Qwen 已發布 Qwen3-Max-Thinking,這是一款旗艦推理模型,具備自適應工具使用與多輪測試時縮放策略,以與 GPT-5.2-Thinking 與 Claude-Opus-4.5 競爭。

25

Qwen3-TTS 版本說明:開源語音設計、克隆與生成

Qwen 已開源 Qwen3-TTS 系列,提供 0.6B 與 1.7B 兩種規模的模型,支援高保真語音克隆、以自然語言進行語音設計,以及跨 10 種語言的超低延遲串流語音生成。

26

Qwen3-VL-Embedding 與 Qwen3-VL-Reranker 發布

Qwen 已發布 Qwen3-VL-Embedding 與 Qwen3-VL-Reranker,這是一系列針對文字、圖像、螢幕截圖與影片進行高精度跨模態檢索的多模態模型。

27

Qwen-Image-2512 發行說明 / 新功能

Qwen-Image-2512 是 Qwen-Image 文本到圖像模型的十二月更新,顯著提升了人物寫實度、自然細節渲染以及複雜文字版面配置的準確性。

28

Qwen-Image-Edit-2511 發行說明

Qwen-Image-Edit-2511 是一個更新的圖像編輯模型,提升了角色一致性,整合了社群 LoRA,並增強了幾何推理與工業設計能力。

29

Qwen3‑TTS‑VD‑Flash 與 Qwen3‑TTS‑VC‑Flash 發布:可控語音設計與快速多語言語音克隆

Qwen 推出 Qwen3‑TTS‑VD‑Flash 用於自然語言語音設計,並推出 Qwen3‑TTS‑VC‑Flash 用於 3 秒多語言語音克隆,兩者在可控性與準確性上均超越領先的 TTS 系統。

30

Qwen-Image-Layered:層次分解以實現內在可編輯性

Qwen-Image-Layered 是一個新模型,能將圖像分解為多個 RGBA 層,允許獨立操作圖像組件而不影響其他內容。

31

Qwen3-Omni-Flash-2025-12-01 發行說明

Qwen3-Omni-Flash-2025-12-01 是一個升級的原生多模態模型,提升了即時音視互動、系統提示控制,以及跨文字、圖像、音訊與影片等多種模態的多語言支援。

32

SAPO:一種穩定且高效能的強化學習方法,用於訓練大型語言模型

Qwen 推出 Soft Adaptive Policy Optimization(SAPO),這是一種以平滑、受溫度控制的 gating 函數取代硬裁剪的 RL 方法,旨在提升 LLM 訓練的穩定性與樣本效率。

33

Qwen3-TTS-Flash 更新:49 種音色、10 種語言與 9 種方言

Qwen3-TTS-Flash 是一款旗艦級文字轉語音模型,支援 49 種高品質音色、10 種語言以及 9 種中文方言,具備改進的韻律與自然的語速。

34

Qwen DeepResearch 2511 發布

Qwen 已發布 Qwen DeepResearch 2511,這是一款利用多代理協作機制的 AI 研究助理,旨在減少初始靈感與深度技術驗證之間的摩擦。

35

Qwen3Guard 發布:LLM 的即時安全防護欄桿

Qwen 推出 Qwen3Guard,一個安全防護模型家族,提供 Gen 與 Stream 兩種變體,能對提示與回應進行即時且多語言的安全分類。

36

Qwen-Image-Edit 版本說明

Qwen-Image-Edit 是一個 20B 參數的影像編輯模型,透過結合 Qwen2.5-VL 與 VAE Encoder,實現精確的語意與外觀編輯,並支援雙語文字修改。

37

Qwen-Image 發布:原生文字渲染與精準影像編輯

Qwen-Image 是一個 20 億參數的 MMDiT 影像基礎模型,提供最先進的複雜文字渲染與精準影像編輯功能。

38

Qwen GSPO:可擴展的語言模型強化學習

Qwen 推出群組序列策略優化(GSPO),這是一種序列級別的 RL 演算法,較 GRPO 在訓練穩定性與效率上有顯著提升,尤其適用於 Mixture-of-Experts(MoE)模型。

39

Qwen-MT Turbo 發行說明

Qwen 已發布 Qwen-MT(qwen-mt-turbo),這是一款基於輕量化 MoE 的翻譯模型,支援 92 種語言,具備高度可客製化且 API 成本低廉。

40

Qwen3-Coder 發行說明

Qwen 已發布 Qwen3-Coder,一款 Mixture-of-Experts 模型,在代理程式編寫、瀏覽器使用與工具使用方面達到最先進的開源模型表現,與 Claude Sonnet 4 相當。

41

Qwen‑TTS 更新:支援中文方言與雙語合成

Qwen 已發布 Qwen‑TTS(qwen-tts-latest)的更新,加入對北京話、上海話與四川話方言的支援,並提供中英雙語合成。

42

Qwen VLo:統一的多模態理解與生成

Qwen VLo 是一個統一的多模態模型,透過結合高品質影像生成、開放式編輯與精確的視覺理解,在單一系統中彌合感知與創作之間的鴻溝。

43

Qwen3 嵌入與重排序模型發布

Qwen 已發布 Qwen3 嵌入系列,這是一套基於 Qwen3 基礎模型的專有模型,旨在提供最先進的文本嵌入、檢索與重排序,支援超過 100 種語言。

44

Qwen3 版本說明:混合思考與多語言 MoE 模型

Qwen 已發布 Qwen3,這是一系列開放權重模型,具備可擴展推理的混合思考模式,並支援 119 種語言。

45

QVQ-Max 視覺推理模型發布

Qwen 已發布 QVQ-Max,一款能夠分析圖像與影片,解決數學、程式設計與創意任務等複雜問題的視覺推理模型。

46

Qwen2.5‑Omni 發布:即時互動的端到端多模態模型

Qwen 已發布 Qwen2.5‑Omni,一款端到端多模態模型,能處理文字、圖像、音訊與影片,並即時產生串流文字與自然語音回應。

47

Qwen2.5-VL-32B 發布說明

Qwen 已發布 Qwen2.5-VL-32B-Instruct,一款透過強化學習優化的視覺語言模型,具備卓越的數學推理能力、細緻的影像理解以及符合人類偏好的回應。

48

QwQ-32B 版本說明 / 新功能

Qwen 已發布 QwQ-32B,這是一個 320 億參數的推理模型,利用縮放強化學習來達到與更大的 DeepSeek-R1 相媲美的性能。

49

QwQ-Max-Preview 發布

Qwen 已推出 QwQ-Max-Preview,這是一個基於 Qwen2.5-Max 的預覽推理模型,在數學、編碼和 Agent 相關工作流程中表現出色。

50

Qwen2.5-Max 發布說明

Qwen 已發布 Qwen2.5-Max,一種在超過 20 兆個標記上預訓練的大規模混合專家 (MoE) 模型,可透過 API 和 Qwen Chat 使用。