Compare AI models

API pricing
Input price
$2.00$1.75
Output price
$10.00$14.00
Cached input price
$0.20$0.175
Cheapest input
$2.00Amazon Bedrock$1.75Azure
Cheapest output
$10.00Amazon Bedrock$14.00Azure
Benchmarks
BullshitBench v2
80%24%
SWE-Bench Verified
85.2%85%
Next.js Evals
81%68%
OSWorld-Verified
81.2%64.7%
Overview
CompanyAnthropicOpenAI
Release dateJun 30 2026Feb 5 2026
AccessClosedClosed
Model detailsView modelView model

Frequently asked questions

Claude Sonnet 5 leads GPT-5.3-Codex on 4 of the 4 benchmarks they both report (BullshitBench v2, SWE-Bench Verified, Next.js Evals, OSWorld-Verified). GPT-5.3-Codex is cheaper on input: $1.75 vs $2.00 per million tokens. Claude Sonnet 5 is cheaper on output: $10.00 vs $14.00 per million tokens. GPT-5.3-Codex shipped 145 days before Claude Sonnet 5, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On BullshitBench v2, Claude Sonnet 5 leads at 80% vs GPT-5.3-Codex at 24%. On SWE-Bench Verified, Claude Sonnet 5 leads at 85.2% vs GPT-5.3-Codex at 85%. On Next.js Evals, Claude Sonnet 5 leads at 81% vs GPT-5.3-Codex at 68%. On OSWorld-Verified, Claude Sonnet 5 leads at 81.2% vs GPT-5.3-Codex at 64.7%.