Gemini 3.1 ProvsMistral Medium 3.5

Gemini 3.1 Pro
Mistral Medium 3.5
Specifications
Parameters
128B
Context window
256k
API pricing
Input price
$2.00$1.50
Output price
$12.00$7.50
Cached input price
$0.20
Benchmarks
SWE-Bench Verified
80.6%77.6%
Benchmarks
BullshitBench v2
37%
Gray Swan IPI · k = 1
14.2%
Gray Swan IPI · k = 10
45.7%
Gray Swan IPI · k = 15
49.2%
ProgramBench
0%
SWE-Bench Pro
54.2%
DeepSWE 1.1
12%
MLE-Bench
42.6%
Next.js Evals
58%
Terminal-Bench 2.1
70.3%
Terminal-Bench 2.0
68.5%
MCP Atlas
78.2%
Toolathlon
48.8%
BrowseComp
85.9%
Humanity's Last Exam · no tools
44.4%
Humanity's Last Exam · with tools
51.4%
ARC-AGI-2
77.1%
FrontierMath · Tier 1–3
36.9%
FrontierMath · Tier 4
16.7%
GPQA Diamond
94.3%
OSWorld-Verified
76.2%
Finance Agent v2
43%
GDPval-AA
1314
GDPval-AA v2
965
GDPval (win/tie rate)
67.3%
CharXiv Reasoning
83.3%
MMMU-Pro
80.5%
Blueprint-Bench 2
26.5%
MRCR v2 (8-needle) · 128k average
84.9%
MRCR v2 (8-needle) · 1M pointwise
26.3%
Overview
CompanyGoogleMistral
Release dateFeb 19 2026Apr 29 2026
AccessProprietaryOpen Weight

Other comparisons

Gemini 3.1 ProvsClaude Fable 5.1Mistral Medium 3.5vsClaude Fable 5.1Gemini 3.1 ProvsGPT-6 AstraMistral Medium 3.5vsGPT-6 AstraGemini 3.1 ProvsMuse Spark 1.3Mistral Medium 3.5vsMuse Spark 1.3Gemini 3.1 ProvsGrok 4.6Mistral Medium 3.5vsGrok 4.6Gemini 3.1 ProvsDeepSeek-V4.1-FlashMistral Medium 3.5vsDeepSeek-V4.1-FlashGemini 3.1 ProvsKimi K3Mistral Medium 3.5vsKimi K3

Frequently asked questions

Gemini 3.1 Pro leads Mistral Medium 3.5 on 1 of the 1 benchmark they both report (SWE-Bench Verified). Mistral Medium 3.5 is cheaper on both input and output: $1.50 vs $2.00 per million input tokens, and $7.50 vs $12.00 per million output tokens. Figures are base-tier rates. Gemini 3.1 Pro shipped 69 days before Mistral Medium 3.5, so benchmark comparisons should account for the intervening progress.

Gemini 3.1 Pro is proprietary, while Mistral Medium 3.5 is open weight.

On SWE-Bench Verified, Gemini 3.1 Pro leads at 80.6% vs Mistral Medium 3.5 at 77.6%.