Qwen3-Coder 发布说明
Qwen 宣布了 Qwen3-Coder,这是一款面向代理任务的高性能代码模型。旗舰变体 Qwen3-Coder-480B-A35B-Instruct 是一款拥有 4800 亿参数、35B 活跃参数的混合专家(Mixture-of-Experts,MoE)模型,在开源模型中实现了代理式编码、工具使用和浏览器使用的最新水平,性能可与 Claude Sonnet 4 相媲美。
技术架构与预训练
Qwen3-Coder 采用混合专家架构,以在总参数量与计算效率之间取得平衡。预训练过程聚焦于三个主要的扩展维度:
- Token Scaling(令牌扩展): 模型在 7.5 万亿令牌上进行训练,代码比例为 70%,以确保强大的编码能力,同时不牺牲通用知识或数学推理。
- Context Window Scaling(上下文窗口扩展): Qwen3-Coder 原生支持 256K 令牌的上下文窗口,可通过 YaRN 扩展至 100 万令牌。此容量针对处理仓库规模的数据和诸如 Pull Request 等动态输入进行了优化。
- Synthetic Data Scaling(合成数据扩展): 团队使用 Qwen2.5-Coder 对噪声训练数据进行清洗和重写,提高了预训练语料库的整体质量。
训练后与强化学习
Qwen3-Coder 的能力由两种不同的强化学习(RL)策略驱动,分别聚焦于执行和长时程任务。
基于执行的代码 RL
Qwen3-Coder 并非仅专注于竞技编程,而是通过大规模 RL 在广泛的真实编码任务上进行训练。通过自动扩展多样化编码任务的测试用例,模型提升了代码执行成功率以及在其他任务上的整体表现。
长时程代理 RL
为了解决复杂的软件工程任务(如 SWE‑Bench 中的任务),模型接受了 “Agent RL” 训练。该过程鼓励模型进行多轮交互——规划、使用工具并整合反馈,以解决问题。为此,Qwen 在阿里云上构建了可并行运行 20,000 个独立环境的可扩展基础设施。因此,Qwen3-Coder 在 SWE‑Bench Verified 上实现了开源模型的最新水平,且无需在测试时进行扩展。
工具与集成
Qwen 提供了多种将 Qwen3-Coder 集成到开发工作流中的方式:
Qwen Code CLI
Qwen Code 是一个面向研究的命令行界面(CLI)工具,源自 Gemini Code 并针对 Qwen3-Coder 进行了自定义提示和函数调用协议的适配。
第三方工具支持
Qwen3-Coder 与多款流行的开发者工具兼容:
- Claude Code: 用户可以通过代理 API 或
claude-code-router与claude-code-confignpm 包将 Qwen3-Coder 集成。 - Cline: 在 Cline 中,可通过选择 “OpenAI Compatible” 提供商并使用 Dashscope API 端点来配置该模型。
API 访问与未来方向
Qwen3-Coder 可通过阿里云 Model Studio API 使用。通过 OpenAI 兼容接口调用时,使用 qwen3-coder-plus 作为模型标识符。
Qwen3-Coder 的未来开发计划包括发布更多模型规模以降低部署成本,并探索编码代理的自我改进能力,以应对日益复杂的软件工程任务。