Kimi K2.5vsGrok 4.20 Beta

Kimi K2.5
Grok 4.20 Beta
Specifications
Parameters
1T
Context window
256k
API pricing
Input price
$0.60$1.25
Output price
$3.00$2.50
Cached input price
$0.10$0.20
Cheapest input
$0.45SiliconFlow
Cheapest output
$2.25SiliconFlow
Benchmarks
BullshitBench v2
52%56%
SWE-Bench Verified
76.8%76.7%
Benchmarks
Next.js Evals
16%
LiveCodeBench
85%
BrowseComp
60.6%
Humanity's Last Exam · with tools
30.1%
ARC-AGI-2
53.3%
GPQA Diamond
87.6%
Overview
CompanyMoonshot AISpaceXAI
Release dateJan 27 2026Feb 17 2026
AccessOpen WeightProprietary

Other comparisons

Kimi K2.5vsClaude Fable 5.1Grok 4.20 BetavsClaude Fable 5.1Kimi K2.5vsGPT-6 AstraGrok 4.20 BetavsGPT-6 AstraKimi K2.5vsGemini 3.8 FlashGrok 4.20 BetavsGemini 3.8 FlashKimi K2.5vsMuse Spark 1.3Grok 4.20 BetavsMuse Spark 1.3Kimi K2.5vsDeepSeek-V4.1-FlashGrok 4.20 BetavsDeepSeek-V4.1-FlashKimi K2.5vsMistral Medium 3.5Grok 4.20 BetavsMistral Medium 3.5

Frequently asked questions

Kimi K2.5 and Grok 4.20 Beta are evenly matched across the 2 benchmarks they both report (BullshitBench v2, SWE-Bench Verified). Kimi K2.5 is cheaper on input: $0.60 vs $1.25 per million tokens. Grok 4.20 Beta is cheaper on output: $2.50 vs $3.00 per million tokens. Figures are base-tier rates. Kimi K2.5 shipped 21 days before Grok 4.20 Beta, so benchmark comparisons should account for the intervening progress.

Kimi K2.5 is open weight, while Grok 4.20 Beta is proprietary.

On BullshitBench v2, Grok 4.20 Beta leads at 56% vs Kimi K2.5 at 52%. On SWE-Bench Verified, Kimi K2.5 leads at 76.8% vs Grok 4.20 Beta at 76.7%.