Claude Opus 5vsComposer 2.5

Claude Opus 5
Composer 2.5
Specifications
Context window
1M
API pricing
Input price
$5.00
Output price
$25.00
Cached input price
$0.50
Cheapest input
$5.00Amazon Bedrock
Cheapest output
$25.00Amazon Bedrock
Benchmarks
SWE-Bench Pro
79.2%54%
SWE-Bench Multilingual
89.5%79.8%
Next.js Evals
92%81%
Benchmarks
BullshitBench v2
73%
Gray Swan IPI · k = 1
0.2%
Gray Swan IPI · k = 10
1.6%
Gray Swan IPI · k = 15
2%
SWE-Bench Verified
96%
SWE-Bench Multimodal
59.4%
DeepSWE 1.1
68.8%
DeepSWE 1.0
18%
FrontierCode v1.1 (Main) · main split
53.4%
Supabase Evals · with skills
91.3%
Supabase Evals · no skills
89.9%
Frontier-Bench v0.1
43.3%
Terminal-Bench 4.0
51.82%
Terminal-Bench 2.1
73%
Terminal-Bench 2.0
69.3%
Terminal-Bench-Science 0.1
29%
BrowseComp
90.8%
Humanity's Last Exam · no tools
56.3%
Humanity's Last Exam · with tools
64.7%
ARC-AGI-3
30.2%
ARC-AGI-2
90.4%
BioMysteryBench · hard
49.4%
BioMysteryBench · human solved
90.1%
OSWorld 2.0
70.6%
AutomationBench
26%
Harvey's Legal Agent Benchmark (Held-out)
11.7%
HealthBench Professional
59.8%
GDPval-AA v2
1861
AA-Briefcase
1685
Overview
CompanyAnthropicSpaceXAI
Release dateJul 24 2026May 18 2026
AccessProprietaryProprietary

Other comparisons

Claude Opus 5vsGPT-6 AstraComposer 2.5vsGPT-6 AstraClaude Opus 5vsGemini 3.8 FlashComposer 2.5vsGemini 3.8 FlashClaude Opus 5vsMuse Spark 1.3Composer 2.5vsMuse Spark 1.3Claude Opus 5vsDeepSeek-V4-Pro-0813Composer 2.5vsDeepSeek-V4-Pro-0813Claude Opus 5vsMistral Medium 3.5Composer 2.5vsMistral Medium 3.5Claude Opus 5vsKimi K3Composer 2.5vsKimi K3

Frequently asked questions

Claude Opus 5 leads Composer 2.5 on 3 of the 3 benchmarks they both report (SWE-Bench Pro, SWE-Bench Multilingual, Next.js Evals). Only Claude Opus 5 has a verified first-party API price: $5.00 per million input tokens and $25.00 per million output tokens. No pay-as-you-go API rate is tracked for Composer 2.5. Composer 2.5 shipped 67 days before Claude Opus 5, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On SWE-Bench Pro, Claude Opus 5 leads at 79.2% vs Composer 2.5 at 54%. On SWE-Bench Multilingual, Claude Opus 5 leads at 89.5% vs Composer 2.5 at 79.8%. On Next.js Evals, Claude Opus 5 leads at 92% vs Composer 2.5 at 81%.