GPT-5.6 SolvsGrok 4.6

GPT-5.6 Sol
Grok 4.6
API pricing
Input price
$5.00$2.00
Output price
$30.00$6.00
Cached input price
$0.50$0.50
Cheapest input
$4.40Amazon Bedrock$2.20Amazon Bedrock
Cheapest output
$22.00Amazon Bedrock$6.60Amazon Bedrock
Benchmarks
BullshitBench v2
48%66%
DeepSWE 1.1
73%65.9%
Next.js Evals
77%71%
Terminal-Bench 4.0
37.27%20.3%
GDPval-AA v2
17481753
threejseval
14211528
Benchmarks
Gray Swan IPI · k = 1
3.1%
Gray Swan IPI · k = 10
16.3%
Gray Swan IPI · k = 15
20%
ProgramBench
1%
FrontierCode v1.1 (Extended) · extended split
61.3%
APEX-SWE
56.4%
Supabase Evals · with skills
89.9%
Supabase Evals · no skills
75.4%
Frontier-Bench v0.1
34.4%
Terminal-Bench 3.0
26%
Terminal-Bench 2.1
88.8%
APEX-Agents
57.5%
BU Bench
67%
BrowseComp
92.2%
ARC-AGI-2
92.5%
Harvey's Legal Agent Benchmark
15.8%
AA Intelligence Index
61
AA-Briefcase
1577
Overview
CompanyOpenAISpaceXAI
Release dateJun 26 2026Aug 12 2026
AccessProprietaryProprietary

Other comparisons

GPT-5.6 SolvsClaude Fable 5.1Grok 4.6vsClaude Fable 5.1GPT-5.6 SolvsGemini 3.8 FlashGrok 4.6vsGemini 3.8 FlashGPT-5.6 SolvsMuse Spark 1.3Grok 4.6vsMuse Spark 1.3GPT-5.6 SolvsDeepSeek-V4.1-FlashGrok 4.6vsDeepSeek-V4.1-FlashGPT-5.6 SolvsMistral Medium 3.5Grok 4.6vsMistral Medium 3.5GPT-5.6 SolvsKimi K3Grok 4.6vsKimi K3

Frequently asked questions

GPT-5.6 Sol and Grok 4.6 are evenly matched across the 6 benchmarks they both report. Grok 4.6 is cheaper on both input and output: $2.00 vs $5.00 per million input tokens, and $6.00 vs $30.00 per million output tokens. Figures are base-tier rates. GPT-5.6 Sol shipped 47 days before Grok 4.6, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On BullshitBench v2, Grok 4.6 leads at 66% vs GPT-5.6 Sol at 48%. On DeepSWE 1.1, GPT-5.6 Sol leads at 73% vs Grok 4.6 at 65.9%. On Next.js Evals, GPT-5.6 Sol leads at 77% vs Grok 4.6 at 71%. On Terminal-Bench 4.0, GPT-5.6 Sol leads at 37.27% vs Grok 4.6 at 20.3%. On GDPval-AA v2, Grok 4.6 leads at 1753 vs GPT-5.6 Sol at 1748. On threejseval, Grok 4.6 leads at 1528 vs GPT-5.6 Sol at 1421.