Kimi K2.7 CodevsGrok 4.6

Kimi K2.7 Code
Grok 4.6
Specifications
Parameters
1T
Context window
256k
API pricing
Input price
$0.95$2.00
Output price
$4.00$6.00
Cached input price
$0.19$0.50
Cheapest input
$0.66Inceptron$2.20Amazon Bedrock
Cheapest output
$3.00StreamLake$6.60Amazon Bedrock
Benchmarks
DeepSWE 1.1
31%65.9%
Next.js Evals
73%85%
Benchmarks
BullshitBench v2
65%
FrontierCode v1.1 (Extended) · extended split
61.3%
APEX-SWE
56.4%
Terminal-Bench 4.0
20.3%
Terminal-Bench 3.0
26%
APEX-Agents
57.5%
Harvey's Legal Agent Benchmark
15.8%
AA Intelligence Index
61
GDPval-AA v2
1753
AA-Briefcase
1577
Overview
CompanyMoonshot AISpaceXAI
Release dateJun 12 2026Aug 12 2026
AccessOpen WeightProprietary

Other comparisons

Kimi K2.7 CodevsClaude Fable 5.1Grok 4.6vsClaude Fable 5.1Kimi K2.7 CodevsGPT-6 AstraGrok 4.6vsGPT-6 AstraKimi K2.7 CodevsGemini 3.8 FlashGrok 4.6vsGemini 3.8 FlashKimi K2.7 CodevsMuse Spark 1.3Grok 4.6vsMuse Spark 1.3Kimi K2.7 CodevsDeepSeek-V4-Pro-0813Grok 4.6vsDeepSeek-V4-Pro-0813Kimi K2.7 CodevsMistral Medium 3.5Grok 4.6vsMistral Medium 3.5

Frequently asked questions

Grok 4.6 leads Kimi K2.7 Code on 2 of the 2 benchmarks they both report (DeepSWE 1.1, Next.js Evals). Kimi K2.7 Code is cheaper on both input and output: $0.95 vs $2.00 per million input tokens, and $4.00 vs $6.00 per million output tokens. Figures are base-tier rates. Kimi K2.7 Code shipped 61 days before Grok 4.6, so benchmark comparisons should account for the intervening progress.

Kimi K2.7 Code is open weight, while Grok 4.6 is proprietary.

On DeepSWE 1.1, Grok 4.6 leads at 65.9% vs Kimi K2.7 Code at 31%. On Next.js Evals, Grok 4.6 leads at 85% vs Kimi K2.7 Code at 73%.