Claude Opus 4.7vsComposer 2.5

Claude Opus 4.7
Composer 2.5
Specifications
Context window
1M
API pricing
Input price
$5.00
Output price
$25.00
Cached input price
$0.50
Cheapest input
$5.00Amazon Bedrock
Cheapest output
$25.00Amazon Bedrock
Benchmarks
SWE-Bench Pro
64.3%54%
SWE-Bench Multilingual
80.5%79.8%
Next.js Evals
58%81%
Terminal-Bench 2.1
66.1%73%
Terminal-Bench 2.0
69.4%69.3%
Benchmarks
BullshitBench v2
83%
ProgramBench
0%
SWE-Bench Verified
87.6%
DeepSWE 1.0
18%
MCP Atlas
79.1%
BrowseComp
79.3%
CyberGym
73.1%
Humanity's Last Exam · no tools
46.9%
Humanity's Last Exam · with tools
54.7%
ARC-AGI-2
75.8%
FrontierMath · Tier 1–3
43.8%
FrontierMath · Tier 4
22.9%
GPQA Diamond
94.2%
OSWorld-Verified
78%
Finance Agent v2
51.5%
GDPval-AA
1753
GDPval (win/tie rate)
80.3%
CharXiv Reasoning
82.1%
MMMU-Pro
75.2%
Blueprint-Bench 2
24.5%
MRCR v2 (8-needle) · 128k average
59.3%
threejseval
1137
Overview
CompanyAnthropicSpaceXAI
Release dateApr 16 2026May 18 2026
AccessProprietaryProprietary

Other comparisons

Claude Opus 4.7vsGPT-6 AstraComposer 2.5vsGPT-6 AstraClaude Opus 4.7vsGemini 3.8 FlashComposer 2.5vsGemini 3.8 FlashClaude Opus 4.7vsMuse Spark 1.3Composer 2.5vsMuse Spark 1.3Claude Opus 4.7vsDeepSeek-V4.1-FlashComposer 2.5vsDeepSeek-V4.1-FlashClaude Opus 4.7vsMistral Medium 3.5Composer 2.5vsMistral Medium 3.5Claude Opus 4.7vsKimi K3Composer 2.5vsKimi K3

Frequently asked questions

Claude Opus 4.7 leads Composer 2.5 on 3 of the 5 benchmarks they both report. Only Claude Opus 4.7 has a verified first-party API price: $5.00 per million input tokens and $25.00 per million output tokens. No pay-as-you-go API rate is tracked for Composer 2.5. Claude Opus 4.7 shipped 32 days before Composer 2.5, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On SWE-Bench Pro, Claude Opus 4.7 leads at 64.3% vs Composer 2.5 at 54%. On SWE-Bench Multilingual, Claude Opus 4.7 leads at 80.5% vs Composer 2.5 at 79.8%. On Next.js Evals, Composer 2.5 leads at 81% vs Claude Opus 4.7 at 58%. On Terminal-Bench 2.1, Composer 2.5 leads at 73% vs Claude Opus 4.7 at 66.1%. On Terminal-Bench 2.0, Claude Opus 4.7 leads at 69.4% vs Composer 2.5 at 69.3%.