Claude Opus 5vsGemini 3.5 Flash

Claude Opus 5
Gemini 3.5 Flash
Specifications
Context window
1M
API pricing
Input price
$5.00$1.50
Output price
$25.00$9.00
Cached input price
$0.50$0.15
Cheapest input
$5.00Amazon Bedrock
Cheapest output
$25.00Amazon Bedrock
Benchmarks
BullshitBench v2
73%20%
Gray Swan IPI · k = 1
0.2%14.1%
Gray Swan IPI · k = 10
1.6%54.2%
Gray Swan IPI · k = 15
2%60.5%
SWE-Bench Pro
79.2%55.1%
DeepSWE 1.1
68.8%37%
Humanity's Last Exam · no tools
56.3%40.2%
Humanity's Last Exam · with tools
64.7%40.2%
ARC-AGI-2
90.4%72.1%
GDPval-AA v2
18611349
Benchmarks
SWE-Bench Verified
96%
SWE-Bench Multilingual
89.5%
SWE-Bench Multimodal
59.4%
FrontierCode v1.1 (Main) · main split
53.4%
MLE-Bench
49.7%
Next.js Evals
92%
Supabase Evals · with skills
91.3%
Supabase Evals · no skills
89.9%
Frontier-Bench v0.1
43.3%
Terminal-Bench 4.0
51.82%
Terminal-Bench 2.1
76.2%
Terminal-Bench-Science 0.1
29%
MCP Atlas
83.6%
Toolathlon
56.5%
BU Bench
58%
BrowseComp
90.8%
ARC-AGI-3
30.2%
BioMysteryBench · hard
49.4%
BioMysteryBench · human solved
90.1%
OSWorld 2.0
70.6%
OSWorld-Verified
78.4%
AutomationBench
26%
Finance Agent v2
57.9%
Harvey's Legal Agent Benchmark (Held-out)
11.7%
HealthBench Professional
59.8%
GDPval-AA
1656
AA-Briefcase
1685
CharXiv Reasoning
84.2%
MMMU-Pro
83.6%
Blueprint-Bench 2
33.6%
MRCR v2 (8-needle) · 128k average
77.3%
MRCR v2 (8-needle) · 1M pointwise
26.6%
threejseval
1770
Overview
CompanyAnthropicGoogle
Release dateJul 24 2026May 19 2026
AccessProprietaryProprietary

Other comparisons

Claude Opus 5vsGPT-6 AstraGemini 3.5 FlashvsGPT-6 AstraClaude Opus 5vsMuse Spark 1.3Gemini 3.5 FlashvsMuse Spark 1.3Claude Opus 5vsGrok 4.6Gemini 3.5 FlashvsGrok 4.6Claude Opus 5vsDeepSeek-V4-Pro-0813Gemini 3.5 FlashvsDeepSeek-V4-Pro-0813Claude Opus 5vsMistral Medium 3.5Gemini 3.5 FlashvsMistral Medium 3.5Claude Opus 5vsKimi K3Gemini 3.5 FlashvsKimi K3

Frequently asked questions

Claude Opus 5 leads Gemini 3.5 Flash on 10 of the 10 benchmarks they both report. Gemini 3.5 Flash is cheaper on both input and output: $1.50 vs $5.00 per million input tokens, and $9.00 vs $25.00 per million output tokens. Gemini 3.5 Flash shipped 66 days before Claude Opus 5, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On BullshitBench v2, Claude Opus 5 leads at 73% vs Gemini 3.5 Flash at 20%. On Gray Swan IPI · k = 1, Claude Opus 5 leads at 0.2% vs Gemini 3.5 Flash at 14.1%. On Gray Swan IPI · k = 10, Claude Opus 5 leads at 1.6% vs Gemini 3.5 Flash at 54.2%. On Gray Swan IPI · k = 15, Claude Opus 5 leads at 2% vs Gemini 3.5 Flash at 60.5%. On SWE-Bench Pro, Claude Opus 5 leads at 79.2% vs Gemini 3.5 Flash at 55.1%. On DeepSWE 1.1, Claude Opus 5 leads at 68.8% vs Gemini 3.5 Flash at 37%. On Humanity's Last Exam · no tools, Claude Opus 5 leads at 56.3% vs Gemini 3.5 Flash at 40.2%. On Humanity's Last Exam · with tools, Claude Opus 5 leads at 64.7% vs Gemini 3.5 Flash at 40.2%. On ARC-AGI-2, Claude Opus 5 leads at 90.4% vs Gemini 3.5 Flash at 72.1%. On GDPval-AA v2, Claude Opus 5 leads at 1861 vs Gemini 3.5 Flash at 1349.