Claude Opus 5vsGemini 3.7 Flash

Claude Opus 5
Gemini 3.7 Flash
Specifications
Context window
1M1M
API pricing
Input price
$5.00$0.75
Output price
$25.00$3.75
Cached input price
$0.50$0.075
Cheapest input
$5.00Amazon Bedrock
Cheapest output
$25.00Amazon Bedrock
Benchmarks
BullshitBench v2
73%35%
ProgramBench
4.5%0%
DeepSWE 1.1
68.8%65.3%
FrontierCode v1.1 (Main) · main split
53.4%43.6%
Terminal-Bench 4.0
51.82%11.21%
BioMysteryBench · hard
49.4%43.5%
BioMysteryBench · human solved
90.1%87.1%
OSWorld 2.0
70.6%38.1%
AutomationBench
26%30.4%
GDPval-AA v2
18611525
threejseval
17701526
Benchmarks
Gray Swan IPI · k = 1
0.2%
Gray Swan IPI · k = 10
1.6%
Gray Swan IPI · k = 15
2%
SWE-Bench Pro
79.2%
SWE-Bench Verified
96%
SWE-Bench Multilingual
89.5%
SWE-Bench Multimodal
59.4%
Next.js Evals
94%
Supabase Evals · with skills
91.3%
Supabase Evals · no skills
89.9%
Frontier-Bench v0.1
43.3%
Terminal-Bench 3.0
14.9%
Terminal-Bench 2.1
85.8%
Terminal-Bench-Science 0.1
29%
BrowseComp
90.8%
Humanity's Last Exam · no tools
56.3%
Humanity's Last Exam · with tools
64.7%
Humanity's Last Exam (Verified)
53.6%
ARC-AGI-3
30.2%
ARC-AGI-2
90.4%
LAB-Bench 2
82.1%
Agent's Last Exam · pass@1
26.3%
Harvey's Legal Agent Benchmark (Held-out)
11.7%
Harvey's Legal Agent Benchmark
8.8%
HealthBench Professional
59.8%
AA Intelligence Index
56
AA-Briefcase
1685
CharXiv Reasoning
84.5%
GDP.PDF
34%
LVBench
85.4%
MRCR v2 (8-needle) · 128k average
97%
MRCR v2 (8-needle) · 1M pointwise
62.5%
Overview
CompanyAnthropicGoogle
Release dateJul 24 2026Aug 13 2026
AccessProprietaryProprietary

Other comparisons

Claude Opus 5vsGPT-6 AstraGemini 3.7 FlashvsGPT-6 AstraClaude Opus 5vsMuse Spark 1.3Gemini 3.7 FlashvsMuse Spark 1.3Claude Opus 5vsGrok 4.6Gemini 3.7 FlashvsGrok 4.6Claude Opus 5vsDeepSeek-V4.1-FlashGemini 3.7 FlashvsDeepSeek-V4.1-FlashClaude Opus 5vsMistral Medium 3.5Gemini 3.7 FlashvsMistral Medium 3.5Claude Opus 5vsKimi K3Gemini 3.7 FlashvsKimi K3

Frequently asked questions

Claude Opus 5 leads Gemini 3.7 Flash on 10 of the 11 benchmarks they both report. Gemini 3.7 Flash is cheaper on both input and output: $0.75 vs $5.00 per million input tokens, and $3.75 vs $25.00 per million output tokens. Claude Opus 5 shipped 20 days before Gemini 3.7 Flash, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Opus 5) vs 1M (Gemini 3.7 Flash).

On BullshitBench v2, Claude Opus 5 leads at 73% vs Gemini 3.7 Flash at 35%. On ProgramBench, Claude Opus 5 leads at 4.5% vs Gemini 3.7 Flash at 0%. On DeepSWE 1.1, Claude Opus 5 leads at 68.8% vs Gemini 3.7 Flash at 65.3%. On FrontierCode v1.1 (Main) · main split, Claude Opus 5 leads at 53.4% vs Gemini 3.7 Flash at 43.6%. On Terminal-Bench 4.0, Claude Opus 5 leads at 51.82% vs Gemini 3.7 Flash at 11.21%. On BioMysteryBench · hard, Claude Opus 5 leads at 49.4% vs Gemini 3.7 Flash at 43.5%. On BioMysteryBench · human solved, Claude Opus 5 leads at 90.1% vs Gemini 3.7 Flash at 87.1%. On OSWorld 2.0, Claude Opus 5 leads at 70.6% vs Gemini 3.7 Flash at 38.1%. On AutomationBench, Gemini 3.7 Flash leads at 30.4% vs Claude Opus 5 at 26%. On GDPval-AA v2, Claude Opus 5 leads at 1861 vs Gemini 3.7 Flash at 1525. On threejseval, Claude Opus 5 leads at 1770 vs Gemini 3.7 Flash at 1526.