GPT-5.6 SolvsGrok 4.7

GPT-5.6 Sol
Grok 4.7
Specifications
Context window
500k
API pricing
Input price
$5.00$2.00
Output price
$30.00$6.00
Cached input price
$0.50$0.50
Cheapest input
$4.40Amazon Bedrock
Cheapest output
$22.00Amazon Bedrock
Benchmarks
DeepSWE 1.1
73%71%
Terminal-Bench 4.0
37.27%38%
Benchmarks
BullshitBench v2
48%
Gray Swan IPI · k = 1
3.1%
Gray Swan IPI · k = 10
16.3%
Gray Swan IPI · k = 15
20%
ProgramBench
1%
Next.js Evals
77%
Supabase Evals · with skills
84.1%
Supabase Evals · no skills
58%
Frontier-Bench v0.1
34.4%
Terminal-Bench 2.1
88.8%
BU Bench
67%
BrowseComp
92.2%
ARC-AGI-2
92.5%
EEBench
64%
Harvey's Legal Agent Benchmark
19.6%
HealthBench Professional
56.7%
GDPval-AA v2.1
1695
GDPval-AA v2
1748
AA-Briefcase v1.1
1657
threejseval
1427
Overview
CompanyOpenAISpaceXAI
Release dateJun 26 2026Sep 21 2026
AccessProprietaryProprietary

Other comparisons

GPT-5.6 SolvsClaude Fable 5.1Grok 4.7vsClaude Fable 5.1GPT-5.6 SolvsGemini 3.8 FlashGrok 4.7vsGemini 3.8 FlashGPT-5.6 SolvsMuse Spark 1.3Grok 4.7vsMuse Spark 1.3GPT-5.6 SolvsDeepSeek-V4.1-FlashGrok 4.7vsDeepSeek-V4.1-FlashGPT-5.6 SolvsMistral Medium 3.5Grok 4.7vsMistral Medium 3.5GPT-5.6 SolvsKimi K3Grok 4.7vsKimi K3

Frequently asked questions

GPT-5.6 Sol and Grok 4.7 are evenly matched across the 2 benchmarks they both report (DeepSWE 1.1, Terminal-Bench 4.0). Grok 4.7 is cheaper on both input and output: $2.00 vs $5.00 per million input tokens, and $6.00 vs $30.00 per million output tokens. Figures are base-tier rates. GPT-5.6 Sol shipped 87 days before Grok 4.7, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On DeepSWE 1.1, GPT-5.6 Sol leads at 73% vs Grok 4.7 at 71%. On Terminal-Bench 4.0, Grok 4.7 leads at 38% vs GPT-5.6 Sol at 37.27%.