Claude 3.7 SonnetvsGrok 4.20 Beta

Claude 3.7 Sonnet
Grok 4.20 Beta
API pricing
Input price
$1.25
Output price
$2.50
Cached input price
$0.20
Benchmarks
BullshitBench v2
49%56%
SWE-Bench Verified
62.3%76.7%
Benchmarks
ARC-AGI-2
53.3%
GPQA Diamond
68%
Overview
CompanyAnthropicSpaceXAI
Release dateFeb 24 2025Feb 17 2026
AccessProprietaryProprietary

Other comparisons

Claude 3.7 SonnetvsGPT-6 AstraGrok 4.20 BetavsGPT-6 AstraClaude 3.7 SonnetvsGemini 3.8 FlashGrok 4.20 BetavsGemini 3.8 FlashClaude 3.7 SonnetvsMuse Spark 1.3Grok 4.20 BetavsMuse Spark 1.3Claude 3.7 SonnetvsDeepSeek-V4.1-FlashGrok 4.20 BetavsDeepSeek-V4.1-FlashClaude 3.7 SonnetvsMistral Medium 3.5Grok 4.20 BetavsMistral Medium 3.5Claude 3.7 SonnetvsKimi K3Grok 4.20 BetavsKimi K3

Frequently asked questions

Grok 4.20 Beta leads Claude 3.7 Sonnet on 2 of the 2 benchmarks they both report (BullshitBench v2, SWE-Bench Verified). Only Grok 4.20 Beta has a verified first-party API price: $1.25 per million input tokens and $2.50 per million output tokens. No pay-as-you-go API rate is tracked for Claude 3.7 Sonnet. Claude 3.7 Sonnet shipped 358 days before Grok 4.20 Beta, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On BullshitBench v2, Grok 4.20 Beta leads at 56% vs Claude 3.7 Sonnet at 49%. On SWE-Bench Verified, Grok 4.20 Beta leads at 76.7% vs Claude 3.7 Sonnet at 62.3%.