Qwen3.8 发布:2.4T 参数开源权重模型
Qwen3.8 发布:2.4T 参数开源权重模型
Qwen3.8 为开源权重 AI 引入 2.4 万亿参数
阿里巴巴宣布推出 Qwen3.8,这是一个拥有 2.4 万亿参数的海量大语言模型 (LLM)。该模型旨在与领先的前沿 AI 系统竞争,并将以开源权重模型的形式发布,这标志着开源 AI 可用性的规模实现了重大提升。
根据官方公告,阿里巴巴将 Qwen3.8 定位为当前可用最强大的模型之一,并表示它“与领先的前沿 AI 模型兼容,仅次于 Fable 5”。
可用性与访问方式
Qwen3.8 正在分阶段推出,在全面开源权重发布之前,将首先推出预览版。
预览版访问
- Qwen3.8-Max-Preview: 目前可通过阿里巴巴的 Token Plan、Qoder 和 QoderWork 进行测试。
- Qwen Chat: 用户也可以通过 Qwen chat 界面免费访问该模型。
开源权重策略
虽然全面开源权重发布尚在等待中,但行业观察人士认为,此举是针对中国 AI 实验室之间日益激烈的竞争的战略性回应。具体而言,该公告是在 Moonshot AI 发布 Kimi K3 之后发布的,Kimi K3 是一个拥有 2.8 万亿参数的开源权重 LLM,计划于 7 月 27 日在 Hugging Face 上发布。
技术影响与社区讨论
Qwen3.8 的规模引发了关于硬件需求、性能以及更广泛的 AI 竞争格局的重大讨论。
硬件与本地推理
鉴于 2.4T 参数量,社区成员对阿里巴巴是否会发布该模型的更小、经过蒸馏或量化后的版本表示了兴趣。之前 Qwen 迭代版本(如 35B MoE 和 27B dense 模型)的用户强调了在本地运行模型以处理敏感或个人数据,而不依赖于 Claude 等云服务商的实用性。
性能与基准测试
虽然阿里巴巴声称该模型仅次于 Fable 5,但一些用户对“基准测试刷榜 (benchmark princessing)”表示了担忧——即模型在标准测试中表现异常出色,但在现实世界中可能缺乏鲁棒性。此外,也有人将其与其他中国模型进行比较:
"DeepSeek V4 Pro 比 Qwen 3.7 Max 更好、更快、且便宜得多。"
中国 AI 的战略转向
观察人士指出,中国实验室的策略正在发生转变,从“价值”模型(针对效率进行优化)转向“智能、庞大且缓慢”的模型。这种转变的特点是更高的 token 需求量和更高的计算需求,正如最近 GLM 和 Kimi 的发布版本所见。
竞争格局
Qwen3.8 进入了一个预期会有多次重大更新的市场:
- Moonshot AI: 正在发布 Kimi K3 (2.8T 参数)。
- DeepSeek: 预计将推出 DeepSeek 4 的“最终”版本,并预期其性能可能达到 Opus 4.8 的水平。
- Anthropic: 通过 Fable 5 维持着被感知的“护城河”,而 Qwen3.8 明确旨在接近其水平。