Gemini 3.7 FlashvsGPT-6 Luna

Gemini 3.7 Flash
GPT-6 Luna
Specifications
Context window
1M1.05M
API pricing
Input price
$0.75$0.10
Output price
$3.75$0.50
Cached input price
$0.075$0.01
Cheapest input
$0.375Google AI Studio
Cheapest output
$1.875Google AI Studio
Benchmarks
DeepSWE 1.1
65.3%66.6%
Benchmarks
BullshitBench v2
35%
ProgramBench
0%
FrontierCode v1.1 (Main) · main split
43.6%
Terminal-Bench 4.0
11.21%
Terminal-Bench 3.0
14.9%
Terminal-Bench 2.1
85.8%
Humanity's Last Exam (Verified)
53.6%
BioMysteryBench · hard
43.5%
BioMysteryBench · human solved
87.1%
LAB-Bench 2
82.1%
OSWorld 2.0
38.1%
Agent's Last Exam · pass@1
26.3%
AutomationBench
30.4%
Harvey's Legal Agent Benchmark
8.8%
AA Intelligence Index
56
GDPval-AA v2
1525
CharXiv Reasoning
84.5%
GDP.PDF
34%
LVBench
85.4%
MRCR v2 (8-needle) · 128k average
97%
MRCR v2 (8-needle) · 1M pointwise
62.5%
threejseval
1533
Overview
CompanyGoogleOpenAI
Release dateAug 13 2026Sep 22 2026
AccessProprietaryProprietary

Other comparisons

Gemini 3.7 FlashvsClaude Opus 5.5GPT-6 LunavsClaude Opus 5.5Gemini 3.7 FlashvsMuse Spark 1.3GPT-6 LunavsMuse Spark 1.3Gemini 3.7 FlashvsGrok 4.7GPT-6 LunavsGrok 4.7Gemini 3.7 FlashvsDeepSeek-V4.1-FlashGPT-6 LunavsDeepSeek-V4.1-FlashGemini 3.7 FlashvsMistral Medium 3.5GPT-6 LunavsMistral Medium 3.5Gemini 3.7 FlashvsKimi K3GPT-6 LunavsKimi K3

Frequently asked questions

GPT-6 Luna leads Gemini 3.7 Flash on 1 of the 1 benchmark they both report (DeepSWE 1.1). GPT-6 Luna is cheaper on both input and output: $0.10 vs $0.75 per million input tokens, and $0.50 vs $3.75 per million output tokens. Figures are base-tier rates. Gemini 3.7 Flash shipped 40 days before GPT-6 Luna, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Gemini 3.7 Flash) vs 1.05M (GPT-6 Luna).

On DeepSWE 1.1, GPT-6 Luna leads at 66.6% vs Gemini 3.7 Flash at 65.3%.