Gemini 3.0 Flashvsgpt-oss-120b

Gemini 3.0 Flash
gpt-oss-120b
Specifications
Parameters
117B
Context window
128k
API pricing
Cheapest input
$0.03AkashML
Cheapest output
$0.17AkashML
Benchmarks
SWE-Bench Verified
78%62.4%
Humanity's Last Exam · no tools
33.7%14.9%
GPQA Diamond
90.4%80.1%
Benchmarks
BullshitBench v2
11%
SWE-Bench Pro
49.6%
Terminal-Bench 2.1
58%
MCP Atlas
62%
Toolathlon
49.4%
Humanity's Last Exam · with tools
19%
ARC-AGI-2
33.6%
MMLU
90%
OSWorld-Verified
65.1%
Finance Agent v2
42.6%
GDPval-AA
1204
CharXiv Reasoning
80.3%
MMMU-Pro
81.2%
Blueprint-Bench 2
0%
MRCR v2 (8-needle) · 128k average
67.2%
MRCR v2 (8-needle) · 1M pointwise
22.1%
Overview
CompanyGoogleOpenAI
Release dateDec 17 2025Aug 5 2025
AccessProprietaryOpen Weight

Other comparisons

Gemini 3.0 FlashvsClaude Opus 5gpt-oss-120bvsClaude Opus 5Gemini 3.0 FlashvsMuse Glimmergpt-oss-120bvsMuse GlimmerGemini 3.0 FlashvsGrok 4.6gpt-oss-120bvsGrok 4.6Gemini 3.0 FlashvsDeepSeek-V4-Pro-0813gpt-oss-120bvsDeepSeek-V4-Pro-0813Gemini 3.0 FlashvsMistral Medium 3.5gpt-oss-120bvsMistral Medium 3.5Gemini 3.0 FlashvsKimi K3gpt-oss-120bvsKimi K3

Frequently asked questions

Gemini 3.0 Flash leads gpt-oss-120b on 3 of the 3 benchmarks they both report (SWE-Bench Verified, Humanity's Last Exam, GPQA Diamond). gpt-oss-120b shipped 134 days before Gemini 3.0 Flash, so benchmark comparisons should account for the intervening progress.

Gemini 3.0 Flash is proprietary, while gpt-oss-120b is open weight.

On SWE-Bench Verified, Gemini 3.0 Flash leads at 78% vs gpt-oss-120b at 62.4%. On Humanity's Last Exam · no tools, Gemini 3.0 Flash leads at 33.7% vs gpt-oss-120b at 14.9%. On GPQA Diamond, Gemini 3.0 Flash leads at 90.4% vs gpt-oss-120b at 80.1%.

Gemini 3.0 Flash was released by Google on Dec 17 2025.

gpt-oss-120b was released by OpenAI on Aug 5 2025.

Gemini 3.0 Flash leads on SWE-Bench Verified — Gemini 3.0 Flash 78% vs gpt-oss-120b 62.4%.

Gemini 3.0 Flash leads on Humanity's Last Exam · no tools — Gemini 3.0 Flash 33.7% vs gpt-oss-120b 14.9%.

Gemini 3.0 Flash is a proprietary model released by Google. gpt-oss-120b is an open weight model released by OpenAI.