Qwen3.6vsComposer 2.5

Qwen3.6
Composer 2.5
Specifications
Parameters
35B
Context window
256k
Benchmarks
Agentic coding
SWE-Bench Pro
49.5%
54%Best
Coding
SWE-Bench Verified
73.4%
Multilingual coding
SWE-Bench Multilingual
67.2%
79.8%Best
Agentic coding
CursorBench v3.2
56.1%
Agentic coding
CursorBench v3.1
63.2%
Agentic coding
DeepSWE 1.0
18%
Next.js coding
Next.js Evals
92%
Agentic terminal coding
Terminal-Bench 2.1
73%
Agentic terminal coding
Terminal-Bench 2.0
51.5%
69.3%Best
Multidisciplinary reasoning
Humanity's Last Exam · no tools
21.4%
Science
GPQA Diamond
86%
Chart reasoning
CharXiv Reasoning
78%
Multimodal reasoning
MMMU-Pro
75.3%
Multimodal
MMMU
81.7%
Overview
CompanyQwenSpaceXAI
Release dateApr 16 2026May 18 2026
AccessOpen WeightProprietary

Which is better: Qwen3.6 or Composer 2.5?

Composer 2.5 leads Qwen3.6 on 3 of the 3 benchmarks they both report (SWE-Bench Pro, SWE-Bench Multilingual, Terminal-Bench 2.0). Qwen3.6 shipped 32 days before Composer 2.5, so benchmark comparisons should account for the intervening progress.

Qwen3.6 is open weight, while Composer 2.5 is proprietary.

On SWE-Bench Pro, Composer 2.5 leads at 54% vs Qwen3.6 at 49.5%. On SWE-Bench Multilingual, Composer 2.5 leads at 79.8% vs Qwen3.6 at 67.2%. On Terminal-Bench 2.0, Composer 2.5 leads at 69.3% vs Qwen3.6 at 51.5%.

Frequently asked questions

Qwen3.6 was released by Qwen on Apr 16 2026.

Composer 2.5 was released by SpaceXAI on May 18 2026.

Composer 2.5 leads on SWE-Bench Pro — Qwen3.6 49.5% vs Composer 2.5 54%.

Qwen3.6 is an open weight model released by Qwen. Composer 2.5 is a proprietary model released by SpaceXAI.

Other comparisons