Compare AI models

Specifications
Context window
1M1M
API pricing
Input price
$5.00$0.75
Output price
$25.00$3.75
Cached input price
$0.50$0.075
Cheapest input
$5.00Amazon Bedrock$0.375Google
Cheapest output
$25.00Amazon Bedrock$1.875Google
Benchmarks
BullshitBench v2
95%35%
ProgramBench
0%0%
Terminal-Bench 4.0
23.64%11.21%
Terminal-Bench 2.1
74.6%85.8%
ARC-AGI-2
72.08%84.6%
Harvey's Legal Agent Benchmark
9.58%8.8%
GDPval-AA v2
16001525
Overview
CompanyAnthropicGoogle
Release dateMay 28 2026Aug 13 2026
AccessClosedClosed
Model detailsView modelView model

Frequently asked questions

Claude Opus 4.8 leads Gemini 3.7 Flash on 4 of the 7 benchmarks they both report. Gemini 3.7 Flash is cheaper on both input and output: $0.75 vs $5.00 per million input tokens, and $3.75 vs $25.00 per million output tokens. Claude Opus 4.8 shipped 77 days before Gemini 3.7 Flash, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Opus 4.8) vs 1M (Gemini 3.7 Flash).

On BullshitBench v2, Claude Opus 4.8 leads at 95% vs Gemini 3.7 Flash at 35%. On ProgramBench, both models score 0%. On Terminal-Bench 4.0, Claude Opus 4.8 leads at 23.64% vs Gemini 3.7 Flash at 11.21%. On Terminal-Bench 2.1, Gemini 3.7 Flash leads at 85.8% vs Claude Opus 4.8 at 74.6%. On ARC-AGI-2, Gemini 3.7 Flash leads at 84.6% vs Claude Opus 4.8 at 72.08%. On Harvey's Legal Agent Benchmark, Claude Opus 4.8 leads at 9.58% vs Gemini 3.7 Flash at 8.8%. On GDPval-AA v2, Claude Opus 4.8 leads at 1600 vs Gemini 3.7 Flash at 1525.