GPT-5.4vsComposer 2.5

GPT-5.4
Composer 2.5
API pricing
Input price
$2.50
Output price
$15.00
Cached input price
$0.25
Cheapest input
$2.50Azure
Cheapest output
$15.00Azure
Benchmarks
Next.js Evals
77%81%
Terminal-Bench 2.0
75.1%69.3%
Benchmarks
BullshitBench v2
48%
SWE-Bench Pro
54%
SWE-Bench Multilingual
79.8%
DeepSWE 1.0
18%
Terminal-Bench 2.1
73%
Expert-SWE (Internal)
68.5%
Toolathlon
54.6%
BrowseComp
82.7%
CyberGym
79%
Humanity's Last Exam · with tools
52.1%
ARC-AGI-2
73.95%
FrontierMath · Tier 1–3
47.6%
FrontierMath · Tier 4
27.1%
GPQA Diamond
92.8%
OSWorld-Verified
75%
GDPval (win/tie rate)
83%
Overview
CompanyOpenAISpaceXAI
Release dateMar 5 2026May 18 2026
AccessProprietaryProprietary

Other comparisons

GPT-5.4vsClaude Fable 5.1Composer 2.5vsClaude Fable 5.1GPT-5.4vsGemini 3.8 FlashComposer 2.5vsGemini 3.8 FlashGPT-5.4vsMuse Spark 1.3Composer 2.5vsMuse Spark 1.3GPT-5.4vsDeepSeek-V4-Pro-0813Composer 2.5vsDeepSeek-V4-Pro-0813GPT-5.4vsMistral Medium 3.5Composer 2.5vsMistral Medium 3.5GPT-5.4vsKimi K3Composer 2.5vsKimi K3

Frequently asked questions

GPT-5.4 and Composer 2.5 are evenly matched across the 2 benchmarks they both report (Next.js Evals, Terminal-Bench 2.0). Only GPT-5.4 has a verified first-party API price: $2.50 per million input tokens and $15.00 per million output tokens. No pay-as-you-go API rate is tracked for Composer 2.5. GPT-5.4 shipped 74 days before Composer 2.5, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On Next.js Evals, Composer 2.5 leads at 81% vs GPT-5.4 at 77%. On Terminal-Bench 2.0, GPT-5.4 leads at 75.1% vs Composer 2.5 at 69.3%.