Qwen3.6vsComposer 2.5

Qwen3.6
Composer 2.5
Specifications
Parameters
35B
Context window
256k
API pricing
Input price
$0.375
Output price
$2.25
Cheapest input
$0.05Darkbloom
Cheapest output
$0.70Darkbloom
Benchmarks
SWE-Bench Pro
49.5%54%
SWE-Bench Multilingual
67.2%79.8%
Terminal-Bench 2.0
51.5%69.3%
Benchmarks
SWE-Bench Verified
73.4%
DeepSWE 1.0
18%
Next.js Evals
81%
Terminal-Bench 2.1
73%
Humanity's Last Exam · no tools
21.4%
GPQA Diamond
86%
CharXiv Reasoning
78%
MMMU-Pro
75.3%
MMMU
81.7%
threejseval
1137
Overview
CompanyQwenSpaceXAI
Release dateApr 16 2026May 18 2026
AccessOpen WeightProprietary

Other comparisons

Qwen3.6vsClaude Fable 5.1Composer 2.5vsClaude Fable 5.1Qwen3.6vsGPT-6 AstraComposer 2.5vsGPT-6 AstraQwen3.6vsGemini 3.8 FlashComposer 2.5vsGemini 3.8 FlashQwen3.6vsMuse Spark 1.3Composer 2.5vsMuse Spark 1.3Qwen3.6vsDeepSeek-V4.1-FlashComposer 2.5vsDeepSeek-V4.1-FlashQwen3.6vsMistral Medium 3.5Composer 2.5vsMistral Medium 3.5

Frequently asked questions

Composer 2.5 leads Qwen3.6 on 3 of the 3 benchmarks they both report (SWE-Bench Pro, SWE-Bench Multilingual, Terminal-Bench 2.0). Only Qwen3.6 has a verified first-party API price: $0.375 per million input tokens and $2.25 per million output tokens. No pay-as-you-go API rate is tracked for Composer 2.5. Qwen3.6 shipped 32 days before Composer 2.5, so benchmark comparisons should account for the intervening progress.

Qwen3.6 is open weight, while Composer 2.5 is proprietary.

On SWE-Bench Pro, Composer 2.5 leads at 54% vs Qwen3.6 at 49.5%. On SWE-Bench Multilingual, Composer 2.5 leads at 79.8% vs Qwen3.6 at 67.2%. On Terminal-Bench 2.0, Composer 2.5 leads at 69.3% vs Qwen3.6 at 51.5%.