AI Model Release Tracker - Analytics

Claude Fable 5vsKimi K2 Thinking

Claude Fable 5
Kimi K2 Thinking
Specifications
Parameters
1T
Context window
1M
256k
Benchmarks
Nonsense detection
BullshitBench v2
54%
Agentic coding
SWE-Bench Pro
80.3%
Coding
SWE-Bench Verified
95.5%Best
71.3%
Agentic coding
CursorBench v3.2
70.5%
Agentic coding
CursorBench v3.1
72.9%
Agentic coding
DeepSWE 1.1
70%
Agentic coding
DeepSWE 1.0
66.1%
Next.js coding
Next.js Evals
92%
Agentic computer work
Frontier-Bench v0.1
33.8%
Agentic terminal coding
Terminal-Bench 2.1
88%
Web browsing
BrowseComp
86.9%
Multidisciplinary reasoning
Humanity's Last Exam · with tools
64.5%
Agentic computer use
OSWorld-Verified
85%
Agentic legal work
Harvey's Legal Agent Benchmark
11.25%
Tax questions
TaxEval v2
76.94%
Medical admin work
MedScribe
88.52%
Knowledge work
GDPval-AA
1932
Knowledge work
GDPval-AA v2
1760
Community preference
Arena Elo (Text)
1509
Community preference (code)
Arena Elo (Code)
1631
Overview
CompanyAnthropicMoonshot AI
Release dateJun 9 2026Nov 6 2025
AccessProprietaryOpen Weight

Which is better: Claude Fable 5 or Kimi K2 Thinking?

Claude Fable 5 leads Kimi K2 Thinking on 1 of the 1 benchmark they both report (SWE-Bench Verified). Kimi K2 Thinking shipped 215 days before Claude Fable 5, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Fable 5) vs 256k (Kimi K2 Thinking). Claude Fable 5 is proprietary, while Kimi K2 Thinking is open weight.

On SWE-Bench Verified, Claude Fable 5 leads at 95.5% vs Kimi K2 Thinking at 71.3%.

Frequently asked questions

Claude Fable 5 was released by Anthropic on Jun 9 2026.

Kimi K2 Thinking was released by Moonshot AI on Nov 6 2025.

Claude Fable 5 leads on SWE-Bench Verified — Claude Fable 5 95.5% vs Kimi K2 Thinking 71.3%.

Claude Fable 5 has a 1M context window; Kimi K2 Thinking has 256k.

Claude Fable 5 is a proprietary model released by Anthropic. Kimi K2 Thinking is an open weight model released by Moonshot AI.

Other comparisons