Qwen3.8-MaxvsComposer 2.5

Qwen3.8-Max
Composer 2.5
Specifications
Parameters
2.4T
Context window
1M
API pricing
Cheapest input
$2.00Alibaba
Cheapest output
$6.00Alibaba
Benchmarks
SWE-Bench Pro
67.7%54%
Terminal-Bench 2.1
86.6%73%
Benchmarks
BullshitBench v2
95%
SWE-Bench Multilingual
79.8%
DeepSWE 1.1
56.6%
DeepSWE 1.0
18%
PaperBench
93%
Next.js Evals
81%
NL2Repo-Bench
55.9%
QwenSWEBench V2
55.1%
Terminal-Bench 3.0
11.3%
Terminal-Bench 2.0
69.3%
JobBench
53.4%
CoWorkBench
74.8%
Toolathlon-Verified
72.5%
Humanity's Last Exam · with tools
43.6%
OSWorld-Verified
86.1%
CharXiv Reasoning
88.4%
BabyVision
82%
MMMU-Pro
82.3%
threejseval
1137
Overview
CompanyQwenSpaceXAI
Release dateAug 3 2026May 18 2026
AccessProprietaryProprietary

Other comparisons

Qwen3.8-MaxvsClaude Fable 5.1Composer 2.5vsClaude Fable 5.1Qwen3.8-MaxvsGPT-6 AstraComposer 2.5vsGPT-6 AstraQwen3.8-MaxvsGemini 3.8 FlashComposer 2.5vsGemini 3.8 FlashQwen3.8-MaxvsMuse Spark 1.3Composer 2.5vsMuse Spark 1.3Qwen3.8-MaxvsDeepSeek-V4.1-FlashComposer 2.5vsDeepSeek-V4.1-FlashQwen3.8-MaxvsMistral Medium 3.5Composer 2.5vsMistral Medium 3.5

Frequently asked questions

Qwen3.8-Max leads Composer 2.5 on 2 of the 2 benchmarks they both report (SWE-Bench Pro, Terminal-Bench 2.1). Composer 2.5 shipped 77 days before Qwen3.8-Max, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On SWE-Bench Pro, Qwen3.8-Max leads at 67.7% vs Composer 2.5 at 54%. On Terminal-Bench 2.1, Qwen3.8-Max leads at 86.6% vs Composer 2.5 at 73%.