Gemini 3.7 FlashvsGPT-6 Astra

Gemini 3.7 Flash
GPT-6 Astra
Specifications
Context window
1M1.05M
API pricing
Input price
$0.75$10.00
Output price
$3.75$50.00
Cached input price
$0.075$1.00
Benchmarks
DeepSWE 1.1
65.3%74.1%
FrontierCode v1.1 (Main) · main split
43.6%53.3%
Agent's Last Exam · pass@1
26.3%59.3%
AutomationBench
30.4%41.4%
AA Intelligence Index
5661.2
Benchmarks
BullshitBench v2
35%
Auto-review circumvention (Internal)
0%
FrontierCode v1.1 (Extended) · extended split
64.5%
AA Coding Agent Index
67
Database Migration Tasks (OpenAI Internal)
63.9%
BenchCAD
95.9%
Terminal-Bench 4.0
57.9%
Terminal-Bench 3.0
14.9%
Terminal-Bench 2.1
85.8%
Terminal-Bench-Science 0.1
64.6%
BrowseComp
91.5%
ExploitBench
100%
Humanity's Last Exam (Verified)
53.6%
ARC-AGI-3
99.9%
FrontierMath · Tier 4 (v2)
97.6%
BioMysteryBench · hard
43.5%
BioMysteryBench · human solved
87.1%
GeneBench-Pro
39%
MedChemBench (Internal)
49.7%
LAB-Bench 2
82.1%
GPQA Diamond
96%
OSWorld 2.0
38.1%
SRE-Bench
99.2%
Harvey's Legal Agent Benchmark
8.8%
HealthBench Professional · length-adjusted
63.4%
GDPval-AA v2
1525
Design Tasks (OpenAI Internal)
50%
Data Science Tasks (OpenAI Internal)
40.9%
CharXiv Reasoning
84.5%
GDP.PDF
34%
LVBench
85.4%
OpenScore String Quartets
0.84
MRCR v2 (8-needle) · 128k average
97%
MRCR v2 (8-needle) · 1M pointwise
62.5%
Overview
CompanyGoogleOpenAI
Release dateAug 13 2026Sep 3 2026
AccessProprietaryProprietary

Other comparisons

Gemini 3.7 FlashvsClaude Fable 5.1GPT-6 AstravsClaude Fable 5.1Gemini 3.7 FlashvsMuse Spark 1.3GPT-6 AstravsMuse Spark 1.3Gemini 3.7 FlashvsGrok 4.6GPT-6 AstravsGrok 4.6Gemini 3.7 FlashvsDeepSeek-V4-Pro-0813GPT-6 AstravsDeepSeek-V4-Pro-0813Gemini 3.7 FlashvsMistral Medium 3.5GPT-6 AstravsMistral Medium 3.5Gemini 3.7 FlashvsKimi K3GPT-6 AstravsKimi K3

Frequently asked questions

GPT-6 Astra leads Gemini 3.7 Flash on 5 of the 5 benchmarks they both report. Gemini 3.7 Flash is cheaper on both input and output: $0.75 vs $10.00 per million input tokens, and $3.75 vs $50.00 per million output tokens. Figures are base-tier rates. Gemini 3.7 Flash shipped 21 days before GPT-6 Astra, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Gemini 3.7 Flash) vs 1.05M (GPT-6 Astra).

On DeepSWE 1.1, GPT-6 Astra leads at 74.1% vs Gemini 3.7 Flash at 65.3%. On FrontierCode v1.1 (Main) · main split, GPT-6 Astra leads at 53.3% vs Gemini 3.7 Flash at 43.6%. On Agent's Last Exam · pass@1, GPT-6 Astra leads at 59.3% vs Gemini 3.7 Flash at 26.3%. On AutomationBench, GPT-6 Astra leads at 41.4% vs Gemini 3.7 Flash at 30.4%. On AA Intelligence Index, GPT-6 Astra leads at 61.2 vs Gemini 3.7 Flash at 56.

Gemini 3.7 Flash was released by Google on Aug 13 2026.

GPT-6 Astra was released by OpenAI on Sep 3 2026.

GPT-6 Astra leads on DeepSWE 1.1 — Gemini 3.7 Flash 65.3% vs GPT-6 Astra 74.1%.

Gemini 3.7 Flash is cheaper on both input and output: $0.75 vs $10.00 per million input tokens, and $3.75 vs $50.00 per million output tokens. Figures are base-tier rates. Rates are pay-as-you-go API prices verified on August 18, 2026.

Gemini 3.7 Flash has a 1M context window; GPT-6 Astra has 1.05M.