Qwen3.6-35B-A3B 릴리즈 노트

Qwen은 고효율 에이전시 코딩 및 멀티모달 추론을 위해 설계된 희소 혼합 전문가(MoE) 모델인 Qwen3.6-35B-A3B를 오픈소스로 공개했습니다. 이 모델은 총 350억 파라미터를 가지고 있지만 활성 파라미터는 30억에 불과해 Qwen3.5-27B와 Gemma4-31B와 같은 훨씬 큰 밀집 모델의 성능에 필적하면서도 활성 연산량이 크게 작습니다.

에이전시 코딩 및 추론 성능

Qwen3.6-35B-A3B는 이전 버전인 Qwen3.5-35B-A3B보다 우수한 성능을 보이며, 여러 코딩 및 에이전시 벤치마크에서 더 큰 밀집 모델과 경쟁합니다. 활성 파라미터가 30억에 불과함에도 불구하고, 밀집 270억 파라미터 모델인 Qwen3.5-27B에 비해 에이전시 코딩 작업에서 뛰어난 결과를 달성합니다.

코딩 에이전트 벤치마크

  • SWE-bench Verified: 73.4 (Qwen3.5-27B 75.0, Qwen3.5-35B-A3B 70.0 대비)
  • Terminal-Bench 2.0: 51.5 (Qwen3.5-27B 41.6 초과)
  • Claw-Eval Avg: 68.7 (Qwen3.5-27B 64.3 초과)
  • NL2Repo: 29.4 (Qwen3.5-27B 27.3 초과)
  • QwenWebBench: 1397 (Qwen3.5-27B 1068 초과)

일반 에이전트 및 지식 벤치마크

  • MCPMark: 37.0 (Qwen3.5-27B 36.3 대비)
  • AIME26: 92.7 (Qwen3.5-27B 92.6 대비)
  • GPQA: 86.0 (Qwen3.5-27B 85.5 대비)

멀티모달 기능

Qwen3.6-35B-A3B는 본래 멀티모달 모델로, 다양한 비전-언어 벤치마크에서 Claude Sonnet 4.5와 동등하거나 그 이상 수준의 인식 및 추론 능력을 제공합니다. 특히 공간 지능 분야에서 강력한 성능을 보입니다.

비전-언어 벤치마크

  • Spatial Intelligence: RefCOCO에서 92.0, ODInW13에서 50.8 달성
  • STEM and Puzzle: MMMU에서 81.7, Mathvista(mini)에서 86.4 달성
  • General VQA: RealWorldQA에서 85.3, MMBench EN-DEV-v1.1에서 92.8 달성
  • Document Understanding: OmniDocBench1.5에서 89.9, CC-OCR에서 81.9 달성
  • Video Understanding: VideoMMMU에서 83.7, MLVU에서 86.2 달성

통합 및 배포

Qwen3.6-35B-A3B는 Hugging Face와 ModelScope에서 오픈 가중치 형태로 제공되며, Alibaba Cloud Model Studio API(qwen3.6-flash)를 통해서도 이용할 수 있습니다.

API 기능 및 호환성

  • Thinking Preservation: API는 preserve_thinking 기능을 지원하여 이전 턴의 생각 내용을 메시지에 유지할 수 있으며, 이는 에이전시 작업에 권장되는 기능입니다.
  • Protocol Support: Alibaba Cloud Model Studio는 OpenAI 호환 채팅 완성 및 응답 API와 Anthropic과 호환되는 API 인터페이스를 지원합니다.

서드파티 코딩 어시스턴트 통합

  • OpenClaw: 자체 호스팅 오픈소스 AI 코딩 에이전트 OpenClaw와 호환됩니다.
  • Qwen Code: Qwen 시리즈에 최적화되어 있으며 터미널 기반 AI 에이전트 형태로 제공됩니다.
  • Claude Code: Qwen API의 Anthropic API 프로토콜 호환성을 통해 지원됩니다.

모델 사양 요약

Feature Specification
Total Parameters 35 Billion
Active Parameters 3 Billion
Architecture Sparse Mixture-of-Experts (MoE)
Availability Open Weights (Hugging Face, ModelScope) / API (qwen3.6-flash)

Sources