Claude 3.5 Sonnet (upgraded)vsGemini 3.8 Flash

Claude 3.5 Sonnet (upgraded)
Gemini 3.8 Flash
Specifications
Context window
1M
API pricing
Cheapest input
$0.375Google
Cheapest output
$1.875Google
Benchmarks
SWE-Bench Verified
49%
DeepSWE 1.1
71%
Next.js Evals
90%
Terminal-Bench 4.0
19.1%
Terminal-Bench 2.1
89.4%
Humanity's Last Exam (Verified)
54.9%
BioMysteryBench · hard
56.5%
BioMysteryBench · human solved
88.8%
LAB-Bench 2
86.2%
OSWorld 2.0
59%
Finance Agent v2
61.4%
Harvey's Legal Agent Benchmark
10%
GDPval-AA v2
1545
CharXiv Reasoning
86.2%
GDP.PDF
35%
LVBench
87.1%
LVBench · agentic
87.8%
threejseval
1625
Overview
CompanyAnthropicGoogle
Release dateOct 22 2024Sep 2 2026
AccessProprietaryProprietary

Other comparisons

Claude 3.5 Sonnet (upgraded)vsGPT-6 AstraGemini 3.8 FlashvsGPT-6 AstraClaude 3.5 Sonnet (upgraded)vsMuse Spark 1.3Gemini 3.8 FlashvsMuse Spark 1.3Claude 3.5 Sonnet (upgraded)vsGrok 4.6Gemini 3.8 FlashvsGrok 4.6Claude 3.5 Sonnet (upgraded)vsDeepSeek-V4.1-FlashGemini 3.8 FlashvsDeepSeek-V4.1-FlashClaude 3.5 Sonnet (upgraded)vsMistral Medium 3.5Gemini 3.8 FlashvsMistral Medium 3.5Claude 3.5 Sonnet (upgraded)vsKimi K3Gemini 3.8 FlashvsKimi K3

Frequently asked questions

Claude 3.5 Sonnet (upgraded) and Gemini 3.8 Flash don't publish scores on any of the same benchmarks, so there's no direct head-to-head comparison. Claude 3.5 Sonnet (upgraded) shipped 680 days before Gemini 3.8 Flash, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

Direct benchmark comparisons are unavailable — Claude 3.5 Sonnet (upgraded) and Gemini 3.8 Flash don't publish scores on any of the same benchmarks.