Gemini 3.8 FlashvsGPT-5.5

Gemini 3.8 Flash
GPT-5.5
Specifications
Context window
1M1.05M
API pricing
Input price
$5.00
Output price
$30.00
Cached input price
$0.50
Cheapest input
$5.00Azure
Cheapest output
$30.00Azure
Benchmarks
Terminal-Bench 2.1
89.4%78.2%
Finance Agent v2
61.4%51.8%
Harvey's Legal Agent Benchmark
10%3.75%
GDPval-AA v2
15451494
CharXiv Reasoning
86.2%84.1%
Benchmarks
BullshitBench v2
47%
Gray Swan IPI · k = 1
3%
Gray Swan IPI · k = 10
17.4%
Gray Swan IPI · k = 15
20.8%
SWE-Bench Pro
58.6%
SWE-Bench Multilingual
77.8%
DeepSWE 1.1
71%
DeepSWE 1.0
64.3%
Terminal-Bench 4.0
19.1%
Terminal-Bench 2.0
82.7%
Expert-SWE (Internal)
73.1%
MCP Atlas
75.3%
Toolathlon
55.6%
BrowseComp
84.4%
CyberGym
81.8%
Humanity's Last Exam · no tools
41.4%
Humanity's Last Exam · with tools
52.2%
Humanity's Last Exam (Verified)
54.9%
ARC-AGI-2
84.6%
FrontierMath · Tier 1–3
51.7%
FrontierMath · Tier 4
35.4%
BioMysteryBench · hard
56.5%
BioMysteryBench · human solved
88.8%
LAB-Bench 2
86.2%
GPQA Diamond
93.6%
OSWorld 2.0
59%
OSWorld-Verified
78.7%
TaxEval v2
74.98%
MedScribe
86.87%
GDPval-AA
1769
GDPval (win/tie rate)
84.9%
GDP.PDF
35%
LVBench
87.1%
LVBench · agentic
87.8%
MMMU-Pro
81.2%
Blueprint-Bench 2
36.2%
MRCR v2 (8-needle) · 128k average
94.8%
Overview
CompanyGoogleOpenAI
Release dateSep 2 2026Apr 23 2026
AccessProprietaryProprietary

Other comparisons

Gemini 3.8 FlashvsClaude Fable 5.1GPT-5.5vsClaude Fable 5.1Gemini 3.8 FlashvsMuse GlimmerGPT-5.5vsMuse GlimmerGemini 3.8 FlashvsGrok 4.6GPT-5.5vsGrok 4.6Gemini 3.8 FlashvsDeepSeek-V4-Pro-0813GPT-5.5vsDeepSeek-V4-Pro-0813Gemini 3.8 FlashvsMistral Medium 3.5GPT-5.5vsMistral Medium 3.5Gemini 3.8 FlashvsKimi K3GPT-5.5vsKimi K3

Frequently asked questions

Gemini 3.8 Flash leads GPT-5.5 on 5 of the 5 benchmarks they both report. Only GPT-5.5 has a verified first-party API price: $5.00 per million input tokens and $30.00 per million output tokens. No pay-as-you-go API rate is tracked for Gemini 3.8 Flash. GPT-5.5 shipped 132 days before Gemini 3.8 Flash, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Gemini 3.8 Flash) vs 1.05M (GPT-5.5).

On Terminal-Bench 2.1, Gemini 3.8 Flash leads at 89.4% vs GPT-5.5 at 78.2%. On Finance Agent v2, Gemini 3.8 Flash leads at 61.4% vs GPT-5.5 at 51.8%. On Harvey's Legal Agent Benchmark, Gemini 3.8 Flash leads at 10% vs GPT-5.5 at 3.75%. On GDPval-AA v2, Gemini 3.8 Flash leads at 1545 vs GPT-5.5 at 1494. On CharXiv Reasoning, Gemini 3.8 Flash leads at 86.2% vs GPT-5.5 at 84.1%.

Gemini 3.8 Flash was released by Google on Sep 2 2026.

GPT-5.5 was released by OpenAI on Apr 23 2026.

Gemini 3.8 Flash leads on Terminal-Bench 2.1 — Gemini 3.8 Flash 89.4% vs GPT-5.5 78.2%.

Only GPT-5.5 has a verified first-party API price: $5.00 per million input tokens and $30.00 per million output tokens. No pay-as-you-go API rate is tracked for Gemini 3.8 Flash. Rates are pay-as-you-go API prices verified on August 18, 2026.

Gemini 3.8 Flash has a 1M context window; GPT-5.5 has 1.05M.