Claude 3.5 Sonnet (upgraded)vsGrok 4.5

Claude 3.5 Sonnet (upgraded)
Grok 4.5
API pricing
Input price
$2.00
Output price
$6.00
Cached input price
$0.30
Benchmarks
BullshitBench v2
55%
Gray Swan IPI · k = 1
13.4%
Gray Swan IPI · k = 10
54.2%
Gray Swan IPI · k = 15
60.8%
SWE-Bench Pro
64.7%
SWE-Bench Verified
49%
SWE-Bench Multilingual
78%
DeepSWE 1.1
54%
DeepSWE 1.0
62%
FrontierCode v1.1 (Extended) · extended split
56.6%
APEX-SWE
53.6%
Next.js Evals
65%
Frontier-Bench v0.1
17.8%
Terminal-Bench 4.0
12.42%
Terminal-Bench 3.0
15.7%
Terminal-Bench 2.1
83.3%
APEX-Agents
47.1%
ARC-AGI-2
52.64%
Harvey's Legal Agent Benchmark
12.92%
MedScribe
86.88%
AA Intelligence Index
56
GDPval-AA v2
1526
AA-Briefcase
1313
Overview
CompanyAnthropicSpaceXAI
Release dateOct 22 2024Jul 8 2026
AccessProprietaryProprietary

Other comparisons

Claude 3.5 Sonnet (upgraded)vsGPT-6 AstraGrok 4.5vsGPT-6 AstraClaude 3.5 Sonnet (upgraded)vsGemini 3.8 FlashGrok 4.5vsGemini 3.8 FlashClaude 3.5 Sonnet (upgraded)vsMuse Spark 1.3Grok 4.5vsMuse Spark 1.3Claude 3.5 Sonnet (upgraded)vsDeepSeek-V4.1-FlashGrok 4.5vsDeepSeek-V4.1-FlashClaude 3.5 Sonnet (upgraded)vsMistral Medium 3.5Grok 4.5vsMistral Medium 3.5Claude 3.5 Sonnet (upgraded)vsKimi K3Grok 4.5vsKimi K3

Frequently asked questions

Claude 3.5 Sonnet (upgraded) and Grok 4.5 don't publish scores on any of the same benchmarks, so there's no direct head-to-head comparison. Only Grok 4.5 has a verified first-party API price: $2.00 per million input tokens and $6.00 per million output tokens. No pay-as-you-go API rate is tracked for Claude 3.5 Sonnet (upgraded). Claude 3.5 Sonnet (upgraded) shipped 624 days before Grok 4.5, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

Direct benchmark comparisons are unavailable — Claude 3.5 Sonnet (upgraded) and Grok 4.5 don't publish scores on any of the same benchmarks.