01

Qwen3.8-Max 릴리스 노트 / 새로운 기능

Qwen은 자율 코딩, 전문 워크플로, 장기 작업에 설계된 2.4조 파라미터 모델인 Qwen3.8-Max를 출시했으며, 오픈 가중치는 다음 주에 도착합니다.

02

Qwen-Image-3.0 릴리스 노트

Qwen-Image-3.0은 현실감과 실용성에 중점을 둔 3세대 이미지 생성 모델로, 복잡한 레이아웃을 위한 4.5k 토큰 입력 지원, 10px 작은 텍스트 렌더링, 12개 언어에 대한 기본 지원을 특징으로 합니다.

03

Qwen-AgentWorld 릴리스: 7개 도메인을 위한 언어 세계 모델 및 일반 에이전트에 대한 영향

Qwen은 Qwen‑AgentWorld를 출시합니다. 이 언어 세계 모델은 7개의 에이전트 환경을 시뮬레이션하고, 제어 가능한 시뮬레이션과 통합된 다음‑상태 예측을 통해 일반 에이전트를 향상시킵니다.

04

Qwen 로봇 스위트: 내비게이션, 조작 및 세계 모델링을 위한 통합 기반 모델

Qwen은 Qwen‑Robot Suite를 소개했습니다—내비게이션, 조작 및 세계 예측 행동으로 언어를 변환하는 세 가지 기반 모델(RobotNav, RobotManip, RobotWorld)로, 수십 개의 구현체에 걸쳐 통합된 에이전트 로봇을 가능하게 합니다.

05

Qwen-RobotWorld: 구현 에이전트를 위한 무한한 세계

Qwen-RobotWorld는 자연어를 보편적인 행동 인터페이스로 활용하여 20개 이상의 로봇 구현체에 걸친 교차 시나리오 물리 일반화를 가능하게 하는 통합 세계 모델입니다.

06

Qwen-RobotManip: 정렬이 로봇 조작 기반 모델의 규모를 열어준다

Qwen-RobotManip은 통합 정렬 프레임워크와 인간‑대‑로봇 데이터 합성 파이프라인을 활용해 다양한 로봇 구현체와 분포 외 작업 전반에 걸쳐 최첨단 일반화를 달성한 Vision-Language-Action (VLA) 기반 모델입니다.

07

Qwen-RobotNav: 에이전트 시스템을 위한 확장 가능한 내비게이션 모델

Qwen-RobotNav는 시각적 컨텍스트를 제어 가능한 추론 시점 인터페이스로 취급함으로써 다섯 개 내비게이션 도메인에서 최첨단 성능을 달성하는 Qwen3-VL 기반의 통합 내비게이션 모델입니다.

08

Qwen3.7-Plus 릴리즈 노트 / 새로운 소식

Qwen3.7-Plus는 비전과 언어를 통합하여 GUI와 CLI 환경에서 복잡한 소프트웨어 엔지니어링 및 생산성 자동화를 수행할 수 있는 멀티모달 에이전트 모델입니다.

09

Qwen-VLA: 구현 지능을 위한 비전-언어-액션 모델링 통합

Qwen-VLA는 로봇 조작, 비전-언어 내비게이션, 그리고 다양한 구현체 제어를 하나의 일반화 정책 모델로 통합하는 범용 비전-언어-액션 모델입니다.

10

Qwen3.7-Max 에이전트 모델 출시

Qwen은 Qwen3.7-Max를 출시했으며, 코딩, 사무 자동화 및 초장기 자율 작업에 뛰어난 새로운 에이전트 중심 기반 모델로, 이제 Alibaba Cloud Model Studio를 통해 이용할 수 있습니다.

11

Qwen3.5-LiveTranslate-Flash 릴리스 노트

Qwen3.5-LiveTranslate-Flash는 Qwen3.5-Omni를 기반으로 구축된 동시 통역 모델로, 초저지연 및 음성 클로닝을 통해 60개 언어에 대한 실시간 다중모달 번역을 제공합니다.

12

Qwen-Scope 해석 가능성 툴킷 출시

Qwen은 Sparse Autoencoders(SAE)를 사용하여 Qwen3 및 Qwen3.5 모델의 은닉 표현을 해석 가능한 특징으로 분해하고 모델 최적화를 위한 해석 가능성 툴킷인 Qwen-Scope를 출시했습니다.

13

FlashQLA: GDN을 위한 CP-/Bwd-친화적 융합 선형 어텐션 커널

Qwen은 TileLang 기반의 고성능 선형 어텐션 커널 라이브러리인 FlashQLA를 오픈소스화했으며, NVIDIA Hopper GPU에서 Gated Delta Network (GDN) 레이어에 대해 전방 2-3배, 후방 2배 속도 향상을 달성합니다.

14

Qwen3.6-27B 릴리스 노트 / 새로운 내용

Qwen은 27억 파라미터의 밀집형 멀티모달 모델인 Qwen3.6-27B를 출시했으며, 모든 주요 에이전트 코딩 벤치마크에서 더 큰 Qwen3.5-397B-A17B를 능가합니다.

15

Qwen3.6-Max-Preview 릴리스 노트 / 새로운 내용

Qwen3.6-Max-Preview는 Qwen이 제공하는 독점 프리뷰 모델로, Qwen3.6-Plus에 비해 에이전시 코딩, 세계 지식, 그리고 지시 수행 능력을 향상시켰습니다.

16

Qwen3.6-35B-A3B 릴리즈 노트

Qwen은 350억 전체 파라미터와 30억 활성 파라미터를 가진 오픈소스 혼합 전문가 모델 Qwen3.6-35B-A3B를 출시했으며, 이는 에이전시 코딩 및 멀티모달 추론에서 더 큰 밀집 모델과 경쟁합니다.

17

산다칸 중앙 시장 표지판 세로 텍스트 2024년 – “2006”

2024년 산다칸 중앙 시장 메인 표지판 오른쪽에 있는 세로 텍스트는 “2006”입니다.

18

Qwen3.5-Omni 릴리스 노트

Qwen은 텍스트, 이미지, 오디오, 비디오를 처리하고 256k 컨텍스트, 113개 언어 음성 인식, 36개 언어 합성을 지원하며, 의미 중단, 웹 검색, 음성 제어, 음성 클로닝과 같은 실시간 기능을 추가한 새로운 옴니모달 LLM인 Qwen3.5-Omni를 발표했습니다.

19

Qwen3.5-Max-Preview 릴리스 (LMSys Arena)

Qwen은 정식 출시가 2주 내에 예정된 가운데, 커뮤니티 평가를 위해 Qwen3.5-Max-Preview를 LMSys Arena에 배포했습니다.

20

Qwen 3.5‑397B‑A17B 출시: 1 M 토큰 컨텍스트와 최첨단 멀티모달 성능을 갖춘 하이브리드 선형‑어텐션 MoE 모델

Qwen 3.5‑397B‑A17B는 토큰당 17 billion 파라미터만 활성화하는 397 billion 파라미터 멀티모달 모델로, 언어, 코딩, 추론 및 비전 작업에서 최첨단 성능을 제공하면서 이전 모델보다 최대 19배 빠릅니다.

21

Qwen-Image-2.0 릴리스: 전문 인포그래픽 및 포토리얼리즘

Qwen-Image-2.0은 전문 인포그래픽을 위한 1k 토큰 지시를 지원하고, 고충실도 포토리얼리즘을 위한 네이티브 2K 해상도를 제공하는 통합 이미지 생성 및 편집 모델입니다.

22

Qwen3-Coder-Next 릴리스: 고효율 에이전트 코딩 모델

Qwen3-Coder-Next는 하이브리드 어텐션과 MoE 아키텍처를 기반으로 하는 오픈-웨이트 모델로, SWE-Bench Verified에서 70% 이상을 달성하며 10-20배 더 큰 모델에 필적하는 성능을 제공합니다.

23

Qwen3-ASR 및 Qwen3-ForcedAligner 릴리스

Qwen은 Qwen3-ASR (1.7B 및 0.6B)와 Qwen3-ForcedAligner-0.6B를 오픈소스로 공개했으며, Apache 2.0 라이선스 하에 최첨단 다국어 음성 인식 및 비자동회귀 타임스탬프 예측 기능을 제공합니다.

24

Qwen3-Max-Thinking 릴리스 노트

Qwen은 적응형 도구 사용 및 다중 라운드 테스트 시점 스케일링 전략을 특징으로 하는 플래그십 추론 모델인 Qwen3-Max-Thinking을 출시했으며, GPT-5.2-Thinking 및 Claude-Opus-4.5와 경쟁합니다.

25

Qwen3-TTS 릴리즈 노트: 오픈소스 음성 디자인, 클로닝 및 생성

Qwen은 Qwen3-TTS 패밀리를 오픈소스화했으며, 0.6B 및 1.7B 모델을 통해 고충실도 음성 클로닝, 자연어 기반 음성 디자인, 그리고 10개 언어에 걸친 초저지연 스트리밍 음성 생성을 가능하게 합니다.

26

Qwen3-VL-Embedding 및 Qwen3-VL-Reranker 출시

Qwen은 텍스트, 이미지, 스크린샷 및 비디오 전반에 걸친 고정밀 교차 모달 검색을 위해 설계된 멀티모달 모델 시리즈인 Qwen3-VL-Embedding 및 Qwen3-VL-Reranker를 출시했습니다.

27

Qwen-Image-2512 릴리스 노트 / 새로운 소식

Qwen-Image-2512는 Qwen-Image 텍스트-이미지 모델의 12월 업데이트로, 인간 사실감, 자연 디테일 렌더링, 복잡한 텍스트 레이아웃 정확성을 크게 향상시킵니다.

28

Qwen-Image-Edit-2511 릴리스 노트

Qwen-Image-Edit-2511은 캐릭터 일관성을 개선하고 커뮤니티 LoRA를 통합하며 기하학적 추론 및 산업 디자인 기능을 강화한 최신 이미지 편집 모델입니다.

29

Qwen3‑TTS‑VD‑Flash 및 Qwen3‑TTS‑VC‑Flash 출시: 제어 가능한 음성 디자인과 빠른 다국어 음성 클로닝

Qwen은 자연어 기반 음성 디자인을 위한 Qwen3‑TTS‑VD‑Flash와 3초 다국어 음성 클로닝을 위한 Qwen3‑TTS‑VC‑Flash를 출시했으며, 두 모델 모두 제어성 및 정확도 면에서 기존 주요 TTS 시스템을 능가합니다.

30

Qwen-Image-Layered: 고유 편집 가능성을 위한 계층적 분해

Qwen-Image-Layered는 이미지를 여러 RGBA 레이어로 분해하여, 다른 콘텐츠에 영향을 주지 않고 이미지 구성 요소를 독립적으로 조작할 수 있게 하는 새로운 모델입니다.

31

Qwen3-Omni-Flash-2025-12-01 릴리스 노트

Qwen3-Omni-Flash-2025-12-01은 텍스트, 이미지, 오디오, 비디오 등 모든 모달리티에서 실시간 오디오-비주얼 상호작용, 시스템 프롬프트 제어, 다국어 지원을 강화한 업그레이드된 네이티브 멀티모달 모델입니다.

32

SAPO: 대형 언어 모델 훈련을 위한 안정적이고 성능 좋은 강화 학습 방법

Qwen은 하드 클리핑을 부드럽고 온도 제어 게이팅 함수로 대체하여 LLM의 훈련 안정성과 샘플 효율성을 향상시키는 RL 방법인 Soft Adaptive Policy Optimization (SAPO)을 소개합니다.

33

Qwen3-TTS-Flash 업데이트: 49개의 음색, 10개 언어, 9개 방언

Qwen3-TTS-Flash는 49개의 고품질 음색, 10개 언어, 9개 중국 방언을 지원하며, 향상된 운율과 자연스러운 말하기 속도를 제공하는 대표적인 텍스트‑투‑스피치 모델입니다.

34

Qwen DeepResearch 2511 릴리스

Qwen은 초기 영감과 깊은 기술 검증 사이의 마찰을 줄이기 위해 다중 에이전트 협업 메커니즘을 활용하는 AI 연구 보조 도구인 Qwen DeepResearch 2511을 출시했습니다.

35

Qwen3Guard 릴리스: LLM을 위한 실시간 안전 가드레일

Qwen은 Qwen3Guard를 소개합니다. 이는 Gen 및 Stream 변형으로 제공되는 안전 가드레일 모델군으로, 프롬프트와 응답에 대한 실시간 다국어 안전 분류를 제공합니다.

36

Qwen-Image-Edit 릴리즈 노트

Qwen-Image-Edit은 Qwen2.5-VL과 VAE 인코더를 활용하여 정확한 의미 및 외관 편집과 양언어 텍스트 수정을 가능하게 하는 20B 파라미터 이미지 편집 모델입니다.

37

Qwen-Image 출시: 네이티브 텍스트 렌더링 및 정밀 이미지 편집

Qwen-Image는 최첨단 복합 텍스트 렌더링 및 정밀 이미지 편집 기능을 제공하는 20B MMDiT 이미지 기반 모델입니다.

38

Qwen GSPO: 언어 모델을 위한 확장 가능한 강화 학습

Qwen은 그룹 시퀀스 정책 최적화(GSPO)를 도입합니다. 이는 시퀀스 수준의 강화 학습 알고리즘으로, 특히 전문가 혼합(MoE) 모델에서 GRPO에 비해 학습 안정성과 효율성을 향상시킵니다.

39

Qwen-MT Turbo 릴리스 노트

Qwen은 92개 언어를 지원하고 높은 맞춤화와 낮은 API 비용을 제공하는 경량 MoE 기반 번역 모델인 Qwen-MT (qwen-mt-turbo)를 출시했습니다.

40

Qwen3-Coder 릴리스 노트

Qwen은 에이전트 코딩, 브라우저 사용 및 도구 사용에서 최첨단 오픈 모델 성능을 달성한 Mixture-of-Experts 모델인 Qwen3-Coder를 출시했으며, Claude Sonnet 4와 견줄 만합니다.

41

Qwen-TTS 업데이트: 중국 방언 및 이중 언어 합성 지원

Qwen은 Qwen-TTS (qwen-tts-latest)의 업데이트를 발표했으며, 베이징어, 상하이어, 쓰촨어 방언 지원과 중국어-영어 이중 언어 합성을 도입했습니다.

42

Qwen VLo: 통합 멀티모달 이해 및 생성

Qwen VLo는 고품질 이미지 생성, 자유로운 편집, 정밀한 시각 이해를 하나의 시스템에 결합하여 인식과 창작 사이의 격차를 메우는 통합 멀티모달 모델입니다.

43

Qwen3 임베딩 및 재랭킹 모델 출시

Qwen은 Qwen3 기반 모델을 기반으로 한 Qwen3 임베딩 시리즈를 출시했으며, 100개 이상의 언어에 걸쳐 최첨단 텍스트 임베딩, 검색 및 재랭킹을 수행하도록 설계된 독점 모델 세트입니다.

44

Qwen3 릴리즈 노트: 하이브리드 사고와 다국어 MoE 모델

Qwen은 확장 가능한 추론을 위한 하이브리드 사고 모드와 119개 언어 지원을 특징으로 하는 오픈-웨이트 모델군인 Qwen3를 출시했습니다.

45

QVQ-Max 시각 추론 모델 출시

Qwen은 이미지와 비디오를 분석하여 수학, 프로그래밍 및 창의적 작업의 복잡한 문제를 해결할 수 있는 시각 추론 모델인 QVQ-Max를 출시했습니다.

46

Qwen2.5-VL-32B 릴리스 노트

Qwen은 강화 학습을 통해 수학적 추론, 세밀한 이미지 이해 및 인간에 맞춘 응답을 최적화한 비전-언어 모델인 Qwen2.5-VL-32B-Instruct를 출시했습니다.

47

QwQ-32B 릴리스 노트 / 새로운 기능

Qwen은 QwQ-32B를 출시했습니다. 이는 스케일된 강화 학습을 활용하여 훨씬 더 큰 DeepSeek-R1과 성능이 비슷한 320억 파라미터 추론 모델입니다.

48

QwQ-Max-Preview 출시

Qwen은 Qwen2.5-Max를 기반으로 한 QwQ-Max-Preview라는 미리보기 추론 모델을 소개했는데, 이는 수학, 코딩, Agent 관련 워크플로우에서 뛰어난 성능을 보인다.

49

Qwen2.5-Max 릴리스 노트

Qwen은 20조 개 이상의 토큰으로 사전 학습된 대규모 Mixture-of-Experts (MoE) 모델인 Qwen2.5-Max를 출시했으며, API와 Qwen Chat을 통해 이용할 수 있습니다.

50

Qwen2.5-1M 릴리스: 1M‑토큰 컨텍스트와 vLLM 기반 추론 프레임워크를 갖춘 오픈소스 7B 및 14B 모델

Qwen은 최대 1백만 토큰 컨텍스트를 지원하는 오픈소스 Qwen2.5‑7B‑Instruct‑1M 및 Qwen2.5‑14B‑Instruct‑1M 모델을 출시하며, 최적화된 vLLM 기반 추론 프레임워크를 함께 제공하여 사전 채우기 속도를 3배에서 7배 향상시키고 GPT‑4o‑mini와 comparable한 단문 작업 성능을 유지합니다.