AI Model Release Tracker - Timeline of Major AI Models from 2022-2026

Claude Opus 4.7 vs Kimi K2.6

Anthropic
Claude Opus 4.7
Moonshot AI
Kimi K2.6
Overview
CompanyAnthropicMoonshot AI
Release dateApr 16 2026Apr 21 2026
AccessProprietaryOpen Weight
Specifications
Parameters
1T
Context window
1M
256k
Benchmarks
Nonsense detection
BullshitBench v2
83%Best
65%
Agentic coding
SWE-Bench Pro
64.3%
Coding
SWE-Bench Verified
87.6%Best
80.2%
Multilingual coding
SWE-Bench Multilingual
80.5%
Agentic coding
CursorBench v3.1
64.8%Best
47.6%
Next.js coding
Next.js Evals
75%Best
67%
Competitive coding
LiveCodeBench
89.6%
Agentic terminal coding
Terminal-Bench 2.1
66.1%
Agentic terminal coding
Terminal-Bench 2.0
69.4%
Multi-step tool use
MCP Atlas
79.1%
Web browsing
BrowseComp
79.3%
Cybersecurity
CyberGym
73.1%
Multidisciplinary reasoning
Humanity's Last Exam · no tools
46.9%
Multidisciplinary reasoning
Humanity's Last Exam · with tools
54.7%
Abstract reasoning
ARC-AGI-2
75.8%
Advanced math
FrontierMath · Tier 1–3
43.8%
Advanced math
FrontierMath · Tier 4
22.9%
Science
GPQA Diamond
94.2%Best
90.5%
Agentic computer use
OSWorld-Verified
78%
Agentic financial analysis
Finance Agent v2
51.5%
Knowledge work
GDPval-AA
1753
Knowledge work
GDPval (win/tie rate)
80.3%
Chart reasoning
CharXiv Reasoning
82.1%
Multimodal reasoning
MMMU-Pro
75.2%
Spatial reasoning
Blueprint-Bench 2
24.5%
Long context
MRCR v2 (8-needle) · 128k average
59.3%
Community preference
Arena Elo (Text)
1503
Community preference (code)
Arena Elo (Code)
1557Best
1513
Timeline
Release gapClaude Opus 4.7 shipped 5 days before Kimi K2.6

Which is better: Claude Opus 4.7 or Kimi K2.6?

Claude Opus 4.7 leads Kimi K2.6 on 6 of the 6 benchmarks they both report. Claude Opus 4.7 shipped 5 days before Kimi K2.6, so benchmark comparisons should account for the intervening progress.

Context windows are 1M (Claude Opus 4.7) vs 256k (Kimi K2.6). Claude Opus 4.7 is proprietary, while Kimi K2.6 is open weight.

On BullshitBench v2, Claude Opus 4.7 leads at 83% vs Kimi K2.6 at 65%. On SWE-Bench Verified, Claude Opus 4.7 leads at 87.6% vs Kimi K2.6 at 80.2%. On CursorBench v3.1, Claude Opus 4.7 leads at 64.8% vs Kimi K2.6 at 47.6%. On Next.js Evals, Claude Opus 4.7 leads at 75% vs Kimi K2.6 at 67%. On GPQA Diamond, Claude Opus 4.7 leads at 94.2% vs Kimi K2.6 at 90.5%. On Arena Elo (Code), Claude Opus 4.7 leads at 1557 vs Kimi K2.6 at 1513.

Frequently asked questions

Claude Opus 4.7 was released by Anthropic on Apr 16 2026.

Kimi K2.6 was released by Moonshot AI on Apr 21 2026.

Claude Opus 4.7 leads on SWE-Bench Verified — Claude Opus 4.7 87.6% vs Kimi K2.6 80.2%.

Claude Opus 4.7 leads on GPQA Diamond — Claude Opus 4.7 94.2% vs Kimi K2.6 90.5%.

Claude Opus 4.7 has a 1M context window; Kimi K2.6 has 256k.

Claude Opus 4.7 is a proprietary model released by Anthropic. Kimi K2.6 is an open weight model released by Moonshot AI.

Other comparisons