Gemini 3.8 FlashvsGrok 4.7

Gemini 3.8 Flash
Grok 4.7
Specifications
Context window
1M500k
API pricing
Input price
$2.00
Output price
$6.00
Cached input price
$0.50
Cheapest input
$0.375Google AI Studio
Cheapest output
$1.875Google AI Studio
Benchmarks
DeepSWE 1.1
71%71%
Terminal-Bench 4.0
19.1%38%
Harvey's Legal Agent Benchmark
10%19.6%
Benchmarks
Next.js Evals
90%
Terminal-Bench 2.1
89.4%
Humanity's Last Exam (Verified)
54.9%
BioMysteryBench · hard
56.5%
BioMysteryBench · human solved
88.8%
LAB-Bench 2
86.2%
EEBench
64%
OSWorld 2.0
59%
Finance Agent v2
61.4%
HealthBench Professional
56.7%
GDPval-AA v2.1
1695
GDPval-AA v2
1545
AA-Briefcase v1.1
1657
CharXiv Reasoning
86.2%
GDP.PDF
35%
LVBench
87.1%
LVBench · agentic
87.8%
threejseval
1631
Overview
CompanyGoogleSpaceXAI
Release dateSep 2 2026Sep 21 2026
AccessProprietaryProprietary

Other comparisons

Gemini 3.8 FlashvsClaude Fable 5.1Grok 4.7vsClaude Fable 5.1Gemini 3.8 FlashvsGPT-6 AstraGrok 4.7vsGPT-6 AstraGemini 3.8 FlashvsMuse Spark 1.3Grok 4.7vsMuse Spark 1.3Gemini 3.8 FlashvsDeepSeek-V4.1-FlashGrok 4.7vsDeepSeek-V4.1-FlashGemini 3.8 FlashvsMistral Medium 3.5Grok 4.7vsMistral Medium 3.5Gemini 3.8 FlashvsKimi K3Grok 4.7vsKimi K3

Frequently asked questions

Grok 4.7 leads Gemini 3.8 Flash on 2 of the 3 benchmarks they both report (DeepSWE 1.1, Terminal-Bench 4.0, Harvey's Legal Agent Benchmark). Only Grok 4.7 has a verified first-party API price: $2.00 per million input tokens and $6.00 per million output tokens. No pay-as-you-go API rate is tracked for Gemini 3.8 Flash. Gemini 3.8 Flash shipped 19 days before Grok 4.7, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Gemini 3.8 Flash) vs 500k (Grok 4.7).

On DeepSWE 1.1, both models score 71%. On Terminal-Bench 4.0, Grok 4.7 leads at 38% vs Gemini 3.8 Flash at 19.1%. On Harvey's Legal Agent Benchmark, Grok 4.7 leads at 19.6% vs Gemini 3.8 Flash at 10%.