Qwen3.8-27BvsComposer 2.5

Qwen3.8-27B
Composer 2.5
Specifications
Parameters
27B
Context window
262k
API pricing
Cheapest input
$0.15Darkbloom
Cheapest output
$2.00Darkbloom
Benchmarks
SWE-Bench Pro
61.7%54%
Terminal-Bench 2.1
73%73%
Benchmarks
BullshitBench v2
78%
SWE-Bench Multilingual
79.8%
DeepSWE 1.1
42.2%
DeepSWE 1.0
18%
Next.js Evals
81%
NL2Repo-Bench
42.3%
QwenSWEBench
79%
LiveCodeBench
90.3%
Terminal-Bench 2.0
69.3%
JobBench
33.4%
CoWorkBench
70.7%
Humanity's Last Exam · no tools
30.8%
Humanity's Last Exam · with tools
30.8%
GPQA Diamond
89.2%
IFBench
79.5%
OSWorld-Verified
84.3%
Agent's Last Exam · pass@1
20.4%
Agent's Last Exam · score
42.9%
Overview
CompanyQwenSpaceXAI
Release dateAug 14 2026May 18 2026
AccessOpen WeightProprietary

Other comparisons

Qwen3.8-27BvsClaude Fable 5.1Composer 2.5vsClaude Fable 5.1Qwen3.8-27BvsGPT-6 AstraComposer 2.5vsGPT-6 AstraQwen3.8-27BvsGemini 3.8 FlashComposer 2.5vsGemini 3.8 FlashQwen3.8-27BvsMuse Spark 1.3Composer 2.5vsMuse Spark 1.3Qwen3.8-27BvsDeepSeek-V4-Pro-0813Composer 2.5vsDeepSeek-V4-Pro-0813Qwen3.8-27BvsMistral Medium 3.5Composer 2.5vsMistral Medium 3.5

Frequently asked questions

Qwen3.8-27B leads Composer 2.5 on 1 of the 2 benchmarks they both report (SWE-Bench Pro, Terminal-Bench 2.1). Composer 2.5 shipped 88 days before Qwen3.8-27B, so benchmark comparisons should account for the intervening progress.

Qwen3.8-27B is open weight, while Composer 2.5 is proprietary.

On SWE-Bench Pro, Qwen3.8-27B leads at 61.7% vs Composer 2.5 at 54%. On Terminal-Bench 2.1, both models score 73%.