QwenLM/Qwen3.8

Qwen3.8 is the large language model series developed by Qwen team, Alibaba Group.

解决的问题

Qwen3.8 是一系列专为处理复杂、多步骤任务而设计的开源权重大语言模型,具备更高的可靠性。它特别针对编程、专业研究以及长期任务型智能体(agentic tasks)的性能提升,为开源社区带来了「Max级」的性能表现。

工作原理

基于 Qwen3.5 的架构基础,该系列经过多轮迭代演进:

  • Qwen3.8:聚焦于自主规划与环境反馈,提升端到端任务完成率。引入 reasoning_effort 以调节推理深度,preserve_thinking 用于在消息间保留推理上下文。
  • Qwen3.6:注重稳定性和现实世界实用性,特别强化了前端工作流中的智能体编程与仓库级推理能力。
  • Qwen3.5:采用统一的视觉-语言基础架构,通过早期融合训练,结合混合架构(门控增量网络与稀疏专家混合模型),并基于百万智能体环境进行强化学习扩展。

适用人群

寻求高性能开源模型用于软件开发、自主智能体及多模态应用的开发者与企业,支持 201 种语言和方言。

核心亮点

  • 智能体能力:更强的自主规划能力,更优的环境反馈处理,确保任务可靠完成。
  • 统一的多模态基础:在数万亿 token 上进行早期融合训练,实现推理、编程与视觉理解能力的均衡对齐。
  • 灵活的思维控制:可调节推理深度,并在对话中保留思考上下文。
  • 广泛兼容性:支持 vLLM、SGLang、TokenSpeed 等主流推理引擎,以及 Unsloth、Llama-Factory 等训练框架。

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch
  • Dispatch