Gemini 3.6 FlashvsGPT-5.4 mini

Gemini 3.6 Flash
GPT-5.4 mini
Specifications
Context window
400k
API pricing
Input price
$0.75$0.75
Output price
$3.75$4.50
Cached input price
$0.075$0.075
Cheapest input
$0.75Azure
Cheapest output
$4.50Azure
Benchmarks
BullshitBench v2
39%32%
ProgramBench
0.5%0%
BU Bench
68%36%
OSWorld-Verified
83%72.1%
Benchmarks
Gray Swan IPI · k = 1
7.3%
Gray Swan IPI · k = 10
32.2%
Gray Swan IPI · k = 15
37.3%
DeepSWE 1.1
49%
MLE-Bench
63.9%
Supabase Evals · with skills
65.2%
Supabase Evals · no skills
55.1%
Humanity's Last Exam · with tools
41.5%
GDPval-AA v2
1421
threejseval
1406
Overview
CompanyGoogleOpenAI
Release dateJul 21 2026Mar 17 2026
AccessProprietaryProprietary

Other comparisons

Gemini 3.6 FlashvsClaude Fable 5.1GPT-5.4 minivsClaude Fable 5.1Gemini 3.6 FlashvsMuse Spark 1.3GPT-5.4 minivsMuse Spark 1.3Gemini 3.6 FlashvsGrok 4.6GPT-5.4 minivsGrok 4.6Gemini 3.6 FlashvsDeepSeek-V4.1-FlashGPT-5.4 minivsDeepSeek-V4.1-FlashGemini 3.6 FlashvsMistral Medium 3.5GPT-5.4 minivsMistral Medium 3.5Gemini 3.6 FlashvsKimi K3GPT-5.4 minivsKimi K3

Frequently asked questions

Gemini 3.6 Flash leads GPT-5.4 mini on 4 of the 4 benchmarks they both report (BullshitBench v2, ProgramBench, BU Bench, OSWorld-Verified). Both charge $0.75 per million input tokens. Gemini 3.6 Flash is cheaper on output: $3.75 vs $4.50 per million tokens. GPT-5.4 mini shipped 126 days before Gemini 3.6 Flash, so benchmark comparisons should account for the intervening progress.

Published specifications for these two models are limited — see each model page for the latest details.

On BullshitBench v2, Gemini 3.6 Flash leads at 39% vs GPT-5.4 mini at 32%. On ProgramBench, Gemini 3.6 Flash leads at 0.5% vs GPT-5.4 mini at 0%. On BU Bench, Gemini 3.6 Flash leads at 68% vs GPT-5.4 mini at 36%. On OSWorld-Verified, Gemini 3.6 Flash leads at 83% vs GPT-5.4 mini at 72.1%.