Claude Opus 4.1vsKimi K2 Thinking

Claude Opus 4.1
Kimi K2 Thinking
Specifications
Parameters
1T
Context window
256k
API pricing
Cheapest input
$15.00Amazon Bedrock$0.60Google
Cheapest output
$75.00Amazon Bedrock$2.50Google
Benchmarks
SWE-Bench Verified
74.5%71.3%
Benchmarks
BullshitBench v2
43%
GPQA Diamond
80.9%
Overview
CompanyAnthropicMoonshot AI
Release dateAug 5 2025Nov 6 2025
AccessProprietaryOpen Weight

Other comparisons

Claude Opus 4.1vsGPT-5.6 SolKimi K2 ThinkingvsGPT-5.6 SolClaude Opus 4.1vsGemini 3.7 FlashKimi K2 ThinkingvsGemini 3.7 FlashClaude Opus 4.1vsMuse GlimmerKimi K2 ThinkingvsMuse GlimmerClaude Opus 4.1vsGrok 4.6Kimi K2 ThinkingvsGrok 4.6Claude Opus 4.1vsDeepSeek-V4-Pro-0813Kimi K2 ThinkingvsDeepSeek-V4-Pro-0813Claude Opus 4.1vsMistral Medium 3.5Kimi K2 ThinkingvsMistral Medium 3.5

Frequently asked questions

Claude Opus 4.1 leads Kimi K2 Thinking on 1 of the 1 benchmark they both report (SWE-Bench Verified). Claude Opus 4.1 shipped 93 days before Kimi K2 Thinking, so benchmark comparisons should account for the intervening progress.

Claude Opus 4.1 is proprietary, while Kimi K2 Thinking is open weight.

On SWE-Bench Verified, Claude Opus 4.1 leads at 74.5% vs Kimi K2 Thinking at 71.3%.

Claude Opus 4.1 was released by Anthropic on Aug 5 2025.

Kimi K2 Thinking was released by Moonshot AI on Nov 6 2025.

Claude Opus 4.1 leads on SWE-Bench Verified — Claude Opus 4.1 74.5% vs Kimi K2 Thinking 71.3%.

Claude Opus 4.1 is a proprietary model released by Anthropic. Kimi K2 Thinking is an open weight model released by Moonshot AI.