Compare AI models

Specifications
Context window
1M—
API pricing
Input price
$5.00$1.50
Output price
$25.00$9.00
Cached input price
$0.50$0.15
Cheapest input
$5.00Amazon Bedrock$0.75Google
Cheapest output
$25.00Amazon Bedrock$4.50Google
Benchmarks
BullshitBench v2
83%20%
ProgramBench
0%0%
SWE-Bench Pro
64.3%55.1%
Terminal-Bench 2.1
66.1%76.2%
MCP Atlas
79.1%83.6%
Humanity's Last Exam · no tools
46.9%40.2%
Humanity's Last Exam · with tools
54.7%40.2%
ARC-AGI-2
75.8%72.1%
OSWorld-Verified
78%78.4%
Finance Agent v2
51.5%57.9%
GDPval-AA
17531656
CharXiv Reasoning
82.1%84.2%
MMMU-Pro
75.2%83.6%
Blueprint-Bench 2
24.5%33.6%
MRCR v2 (8-needle) · 128k average
59.3%77.3%
Overview
CompanyAnthropicGoogle
Release dateApr 16 2026May 19 2026
AccessClosedClosed
Model detailsView modelView model

Frequently asked questions

Gemini 3.5 Flash leads Claude Opus 4.7 on 8 of the 15 benchmarks they both report. Gemini 3.5 Flash is cheaper on both input and output: $1.50 vs $5.00 per million input tokens, and $9.00 vs $25.00 per million output tokens. Claude Opus 4.7 shipped 33 days before Gemini 3.5 Flash, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On BullshitBench v2, Claude Opus 4.7 leads at 83% vs Gemini 3.5 Flash at 20%. On ProgramBench, both models score 0%. On SWE-Bench Pro, Claude Opus 4.7 leads at 64.3% vs Gemini 3.5 Flash at 55.1%. On Terminal-Bench 2.1, Gemini 3.5 Flash leads at 76.2% vs Claude Opus 4.7 at 66.1%. On MCP Atlas, Gemini 3.5 Flash leads at 83.6% vs Claude Opus 4.7 at 79.1%. On Humanity's Last Exam · no tools, Claude Opus 4.7 leads at 46.9% vs Gemini 3.5 Flash at 40.2%. On Humanity's Last Exam · with tools, Claude Opus 4.7 leads at 54.7% vs Gemini 3.5 Flash at 40.2%. On ARC-AGI-2, Claude Opus 4.7 leads at 75.8% vs Gemini 3.5 Flash at 72.1%. On OSWorld-Verified, Gemini 3.5 Flash leads at 78.4% vs Claude Opus 4.7 at 78%. On Finance Agent v2, Gemini 3.5 Flash leads at 57.9% vs Claude Opus 4.7 at 51.5%. On GDPval-AA, Claude Opus 4.7 leads at 1753 vs Gemini 3.5 Flash at 1656. On CharXiv Reasoning, Gemini 3.5 Flash leads at 84.2% vs Claude Opus 4.7 at 82.1%. On MMMU-Pro, Gemini 3.5 Flash leads at 83.6% vs Claude Opus 4.7 at 75.2%. On Blueprint-Bench 2, Gemini 3.5 Flash leads at 33.6% vs Claude Opus 4.7 at 24.5%. On MRCR v2 (8-needle) · 128k average, Gemini 3.5 Flash leads at 77.3% vs Claude Opus 4.7 at 59.3%.