Gemini 2.5 ProvsKimi K3

Gemini 2.5 Pro
Kimi K3
Specifications
Parameters
2.8T
Context window
1M
API pricing
Input price
$1.25$3.00
Output price
$10.00$15.00
Cached input price
$0.125$0.30
Cheapest input
$2.10InferenceNet
Cheapest output
$10.95InferenceNet
Benchmarks
BullshitBench v2
20%74%
Humanity's Last Exam · with tools
18.8%56%
GPQA Diamond
86.4%93.5%
Benchmarks
SWE-Bench Verified
59.6%
DeepSWE 1.1
69%
DeepSWE 1.0
67.5%
Next.js Evals
84%
Supabase Evals · with skills
84.1%
Supabase Evals · no skills
78.3%
Terminal-Bench 2.1
88.3%
MCP Atlas
84.2%
JobBench
52.9%
Toolathlon-Verified
73.2%
BrowseComp
91.2%
Humanity's Last Exam · no tools
43.5%
GDPval-AA v2
1668
CharXiv Reasoning
84.8%
MMMU-Pro
81.6%
MMMU
68%
threejseval
1558
Overview
CompanyGoogleMoonshot AI
Release dateMar 25 2025Jul 16 2026
AccessProprietaryOpen Weight

Other comparisons

Gemini 2.5 ProvsClaude Fable 5.1Kimi K3vsClaude Fable 5.1Gemini 2.5 ProvsGPT-6 AstraKimi K3vsGPT-6 AstraGemini 2.5 ProvsMuse Spark 1.3Kimi K3vsMuse Spark 1.3Gemini 2.5 ProvsGrok 4.6Kimi K3vsGrok 4.6Gemini 2.5 ProvsDeepSeek-V4.1-FlashKimi K3vsDeepSeek-V4.1-FlashGemini 2.5 ProvsMistral Medium 3.5Kimi K3vsMistral Medium 3.5

Frequently asked questions

Kimi K3 leads Gemini 2.5 Pro on 3 of the 3 benchmarks they both report (BullshitBench v2, Humanity's Last Exam, GPQA Diamond). Gemini 2.5 Pro is cheaper on both input and output: $1.25 vs $3.00 per million input tokens, and $10.00 vs $15.00 per million output tokens. Figures are base-tier rates. Gemini 2.5 Pro shipped 478 days before Kimi K3, so benchmark comparisons should account for the intervening progress.

Gemini 2.5 Pro is proprietary, while Kimi K3 is open weight.

On BullshitBench v2, Kimi K3 leads at 74% vs Gemini 2.5 Pro at 20%. On Humanity's Last Exam · with tools, Kimi K3 leads at 56% vs Gemini 2.5 Pro at 18.8%. On GPQA Diamond, Kimi K3 leads at 93.5% vs Gemini 2.5 Pro at 86.4%.