Claude 4 Sonnet vs Kimi K2.5
Head to head on 23 shared benchmarks, with price, context window, and release dates.
Benchmark scores
54evals · sort by any column, ⤢ to expand fullscreen
| Model | |||||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Kimi K2.5 Moonshot AI | 68.3% | 1576elo | 74.9 | 78.9% | 13.2% | 43.7% | 72.5% | 77.9% | 61.4% | 57.4% | 77.7% | 84.9% | 76.0% | 39.3% | 76.4% | 66.5% | 63.3% | 49.9% | 39.6% | 70.8% | 74.2% | 18.9% | 81.3% | - | - | 96.1 | - | - | 39.0% | - | 35.8% | 27.9% | - | 95.4 | 78.5% | 10421 | - | - | 62.0% | - | 87.1 | - | - | - | 73 | - | 67.3% | - | 69.4 | - | 26.3% | 17.5% | - | - | 56.8% |
| Claude 4 Sonnet Anthropic | 54.7% | 1480elo | 58.4 | 68.3% | 4.3% | 45.4% | 64.8% | 77.5% | 54.6% | 44.3% | 72.9% | 70.5% | 69.0% | 33.9% | 72.4% | 62.5% | 43.9% | 35.0% | 37.3% | 74.6% | 69.6% | 27.3% | 52.3% | 40.7% | 38.0% | - | 22.9% | 47.8% | - | 19.8% | - | - | 67.5% | - | - | - | 44.9% | 93.4% | - | 86.7% | - | 83.7% | 6.18 | 6.18 | - | 58.3% | - | 35.6% | - | 0.59 | - | - | 84.0% | 84.0% | 55.5% |
2 / 2 models
| Attribute | Claude 4 Sonnet Anthropic | Kimi K2.5 Moonshot AI |
|---|---|---|
| Description | Claude 4 Sonnet is an AI model from Anthropic. | Kimi K2.5 is an AI model from Kimi. |
| Family | Claude | Kimi |
| Params | - | - |
| Open weights | closed | closed |
| License | proprietary | Modified MIT |
| Released | 22 May 2025 | 27 Jan 2026 |
| Context | 200,000 | 262,144 |
| Input $/1M | $3.00 | $0.60 |
| Output $/1M | $15.00 | $3.00 |
| Cache read $/1M | - | $0.100 |
| Cache write $/1M | - | - |
| Speed | 0 tok/s | 0 tok/s |
| Latency | 0.00 s | 0.00 s |
| Modalities | text, image | text, image |
| Providers | - | - |
| Publisher | Anthropic | Moonshot AI |
| Reported scores | GPQA Diamond78.9% (AA) Humanity's Last Exam (HLE)13.2% (AA) IFBench43.7% (AA) SciCode39.6% (AA) τ²-bench (Tau²-bench)81.3% (AA) |
FAQ
- Is Claude 4 Sonnet or Kimi K2.5 better?
- Across the 23 benchmarks both models report on Sophon, Kimi K2.5 leads on 20 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude 4 Sonnet and Kimi K2.5 compare on GPQA Diamond?
- Claude 4 Sonnet scores 68.3% and Kimi K2.5 scores 78.9% on GPQA Diamond.
- Which is cheaper, Claude 4 Sonnet or Kimi K2.5?
- Kimi K2.5 is cheaper at $3.00 per million output tokens against $15.00 for Claude 4 Sonnet - about 5.0x.
- When were Claude 4 Sonnet and Kimi K2.5 released?
- Claude 4 Sonnet was released 22 May 2025 by Anthropic. Kimi K2.5 was released 27 Jan 2026 by Moonshot AI.
Comparing something else? Build your own side-by-side.