AI Model Release Tracker - Analytics

Claude Fable 5vsKimi K2

Claude Fable 5
Kimi K2
Specifications
Parameters
1T
Context window
1M
128k
Benchmarks
Nonsense detection
BullshitBench v2
54%Best
10%
Agentic coding
SWE-Bench Pro
80.3%
Coding
SWE-Bench Verified
95.5%Best
65.8%
Agentic coding
CursorBench v3.2
70.5%
Agentic coding
CursorBench v3.1
72.9%
Agentic coding
DeepSWE 1.1
70%
Agentic coding
DeepSWE 1.0
66.1%
Next.js coding
Next.js Evals
92%
Agentic computer work
Frontier-Bench v0.1
33.8%
Agentic terminal coding
Terminal-Bench 2.1
88%
Web browsing
BrowseComp
86.9%
Multidisciplinary reasoning
Humanity's Last Exam · with tools
64.5%
Science
GPQA Diamond
75.1%
Agentic computer use
OSWorld-Verified
85%
Agentic legal work
Harvey's Legal Agent Benchmark
11.25%
Tax questions
TaxEval v2
76.94%
Medical admin work
MedScribe
88.52%
Knowledge work
GDPval-AA
1932
Knowledge work
GDPval-AA v2
1760
Community preference
Arena Elo (Text)
1509
Community preference (code)
Arena Elo (Code)
1631
Overview
CompanyAnthropicMoonshot AI
Release dateJun 9 2026Jul 11 2025
AccessProprietaryOpen Weight

Which is better: Claude Fable 5 or Kimi K2?

Claude Fable 5 leads Kimi K2 on 2 of the 2 benchmarks they both report (BullshitBench v2, SWE-Bench Verified). Kimi K2 shipped 333 days before Claude Fable 5, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Fable 5) vs 128k (Kimi K2). Claude Fable 5 is proprietary, while Kimi K2 is open weight.

On BullshitBench v2, Claude Fable 5 leads at 54% vs Kimi K2 at 10%. On SWE-Bench Verified, Claude Fable 5 leads at 95.5% vs Kimi K2 at 65.8%.

Frequently asked questions

Claude Fable 5 was released by Anthropic on Jun 9 2026.

Kimi K2 was released by Moonshot AI on Jul 11 2025.

Claude Fable 5 leads on SWE-Bench Verified — Claude Fable 5 95.5% vs Kimi K2 65.8%.

Claude Fable 5 has a 1M context window; Kimi K2 has 128k.

Claude Fable 5 is a proprietary model released by Anthropic. Kimi K2 is an open weight model released by Moonshot AI.

Other comparisons