0

Claude 4 Sonnet vs Kimi K2.5

Head to head on 23 shared benchmarks, with price, context window, and release dates.

Benchmark scores

54

evals · sort by any column, ⤢ to expand fullscreen

Model
Kimi K2.5

Moonshot AI

68.3%1576elo74.978.9%13.2%43.7%72.5%77.9%61.4%57.4%77.7%84.9%76.0%39.3%76.4%66.5%63.3%49.9%39.6%70.8%74.2%18.9%81.3%--96.1--39.0%-35.8%27.9%-95.478.5%10421--62.0%-87.1---73-67.3%-69.4-26.3%17.5%--56.8%
Claude 4 Sonnet

Anthropic

54.7%1480elo58.468.3%4.3%45.4%64.8%77.5%54.6%44.3%72.9%70.5%69.0%33.9%72.4%62.5%43.9%35.0%37.3%74.6%69.6%27.3%52.3%40.7%38.0%-22.9%47.8%-19.8%--67.5%---44.9%93.4%-86.7%-83.7%6.186.18-58.3%-35.6%-0.59--84.0%84.0%55.5%
2 / 2 models
AttributeClaude 4 Sonnet

Anthropic

Kimi K2.5

Moonshot AI

DescriptionClaude 4 Sonnet is an AI model from Anthropic.Kimi K2.5 is an AI model from Kimi.
FamilyClaudeKimi
Params--
Open weightsclosedclosed
LicenseproprietaryModified MIT
Released22 May 202527 Jan 2026
Context200,000262,144
Input $/1M$3.00$0.60
Output $/1M$15.00$3.00
Cache read $/1M-$0.100
Cache write $/1M--
Speed0 tok/s0 tok/s
Latency0.00 s0.00 s
Modalitiestext, imagetext, image
Providers--
PublisherAnthropicMoonshot AI
Reported scores

FAQ

Is Claude 4 Sonnet or Kimi K2.5 better?
Across the 23 benchmarks both models report on Sophon, Kimi K2.5 leads on 20 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
How do Claude 4 Sonnet and Kimi K2.5 compare on GPQA Diamond?
Claude 4 Sonnet scores 68.3% and Kimi K2.5 scores 78.9% on GPQA Diamond.
Which is cheaper, Claude 4 Sonnet or Kimi K2.5?
Kimi K2.5 is cheaper at $3.00 per million output tokens against $15.00 for Claude 4 Sonnet - about 5.0x.
When were Claude 4 Sonnet and Kimi K2.5 released?
Claude 4 Sonnet was released 22 May 2025 by Anthropic. Kimi K2.5 was released 27 Jan 2026 by Moonshot AI.

Comparing something else? Build your own side-by-side.