Claude Opus 5vsQwen3.6

Claude Opus 5
Qwen3.6
Specifications
Parameters
35B
Context window
1M256k
API pricing
Input price
$5.00$0.375
Output price
$25.00$2.25
Cached input price
$0.50
Cheapest input
$5.00Amazon Bedrock$0.05Darkbloom
Cheapest output
$25.00Amazon Bedrock$0.70Darkbloom
Benchmarks
SWE-Bench Pro
79.2%49.5%
SWE-Bench Verified
96%73.4%
SWE-Bench Multilingual
89.5%67.2%
Humanity's Last Exam · no tools
56.3%21.4%
Benchmarks
BullshitBench v2
73%
Gray Swan IPI · k = 1
0.2%
Gray Swan IPI · k = 10
1.6%
Gray Swan IPI · k = 15
2%
ProgramBench
4.5%
SWE-Bench Multimodal
59.4%
DeepSWE 1.1
68.8%
FrontierCode v1.1 (Main) · main split
53.4%
Next.js Evals
94%
Supabase Evals · with skills
91.3%
Supabase Evals · no skills
89.9%
Frontier-Bench v0.1
43.3%
Terminal-Bench 4.0
51.82%
Terminal-Bench 2.0
51.5%
Terminal-Bench-Science 0.1
29%
BrowseComp
90.8%
Humanity's Last Exam · with tools
64.7%
ARC-AGI-3
30.2%
ARC-AGI-2
90.4%
BioMysteryBench · hard
49.4%
BioMysteryBench · human solved
90.1%
GPQA Diamond
86%
OSWorld 2.0
70.6%
AutomationBench
26%
Harvey's Legal Agent Benchmark (Held-out)
11.7%
HealthBench Professional
59.8%
GDPval-AA v2
1861
AA-Briefcase
1685
CharXiv Reasoning
78%
MMMU-Pro
75.3%
MMMU
81.7%
threejseval
1770
Overview
CompanyAnthropicQwen
Release dateJul 24 2026Apr 16 2026
AccessProprietaryOpen Weight

Other comparisons

Claude Opus 5vsGPT-6 AstraQwen3.6vsGPT-6 AstraClaude Opus 5vsGemini 3.8 FlashQwen3.6vsGemini 3.8 FlashClaude Opus 5vsMuse Spark 1.3Qwen3.6vsMuse Spark 1.3Claude Opus 5vsGrok 4.6Qwen3.6vsGrok 4.6Claude Opus 5vsDeepSeek-V4.1-FlashQwen3.6vsDeepSeek-V4.1-FlashClaude Opus 5vsMistral Medium 3.5Qwen3.6vsMistral Medium 3.5

Frequently asked questions

Claude Opus 5 leads Qwen3.6 on 4 of the 4 benchmarks they both report (SWE-Bench Pro, SWE-Bench Verified, SWE-Bench Multilingual, Humanity's Last Exam). Qwen3.6 is cheaper on both input and output: $0.375 vs $5.00 per million input tokens, and $2.25 vs $25.00 per million output tokens. Qwen3.6 shipped 99 days before Claude Opus 5, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Opus 5) vs 256k (Qwen3.6). Claude Opus 5 is proprietary, while Qwen3.6 is open weight.

On SWE-Bench Pro, Claude Opus 5 leads at 79.2% vs Qwen3.6 at 49.5%. On SWE-Bench Verified, Claude Opus 5 leads at 96% vs Qwen3.6 at 73.4%. On SWE-Bench Multilingual, Claude Opus 5 leads at 89.5% vs Qwen3.6 at 67.2%. On Humanity's Last Exam · no tools, Claude Opus 5 leads at 56.3% vs Qwen3.6 at 21.4%.