Claude Opus 4.1vsGrok 4.5

Claude Opus 4.1
Grok 4.5
API pricing
Input price
$2.00
Output price
$6.00
Cached input price
$0.30
Cheapest input
$15.00Amazon Bedrock
Cheapest output
$75.00Amazon Bedrock
Benchmarks
BullshitBench v2
43%55%
Benchmarks
Gray Swan IPI · k = 1
13.4%
Gray Swan IPI · k = 10
54.2%
Gray Swan IPI · k = 15
60.8%
SWE-Bench Pro
64.7%
SWE-Bench Verified
74.5%
SWE-Bench Multilingual
78%
DeepSWE 1.1
54%
DeepSWE 1.0
62%
FrontierCode v1.1 (Extended) · extended split
56.6%
APEX-SWE
53.6%
Next.js Evals
65%
Frontier-Bench v0.1
17.8%
Terminal-Bench 4.0
12.42%
Terminal-Bench 3.0
15.7%
Terminal-Bench 2.1
83.3%
APEX-Agents
47.1%
ARC-AGI-2
52.64%
GPQA Diamond
80.9%
Harvey's Legal Agent Benchmark
12.92%
MedScribe
86.88%
AA Intelligence Index
56
GDPval-AA v2
1526
AA-Briefcase
1313
Overview
CompanyAnthropicSpaceXAI
Release dateAug 5 2025Jul 8 2026
AccessProprietaryProprietary

Other comparisons

Claude Opus 4.1vsGPT-6 AstraGrok 4.5vsGPT-6 AstraClaude Opus 4.1vsGemini 3.8 FlashGrok 4.5vsGemini 3.8 FlashClaude Opus 4.1vsMuse Spark 1.3Grok 4.5vsMuse Spark 1.3Claude Opus 4.1vsDeepSeek-V4.1-FlashGrok 4.5vsDeepSeek-V4.1-FlashClaude Opus 4.1vsMistral Medium 3.5Grok 4.5vsMistral Medium 3.5Claude Opus 4.1vsKimi K3Grok 4.5vsKimi K3

Frequently asked questions

Grok 4.5 leads Claude Opus 4.1 on 1 of the 1 benchmark they both report (BullshitBench v2). Only Grok 4.5 has a verified first-party API price: $2.00 per million input tokens and $6.00 per million output tokens. No pay-as-you-go API rate is tracked for Claude Opus 4.1. Claude Opus 4.1 shipped 337 days before Grok 4.5, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On BullshitBench v2, Grok 4.5 leads at 55% vs Claude Opus 4.1 at 43%.