Claude Sonnet 4.5 vs GPT-4o-mini
Head to head on 17 shared benchmarks, with price, context window, and release dates.
Benchmark scores
101evals · sort by any column, ⤢ to expand fullscreen
| Model | ||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| GPT-4o-mini OpenAI | 14.7% | 45.5% | 873elo | 42.6% | 4.2% | 31.0% | 72.0% | 47.2% | 43.0% | 65.8% | 32.9% | 23.4% | 78.9% | 64.8% | 54.5% | 22.9% | 60.5% | - | 16.7% | - | 3.6% | 11.7% | - | 50.7% | - | - | - | - | 0.29 | - | 0.0% | - | - | 0.0% | - | - | - | - | - | - | - | - | - | - | - | - | 0.0% | 1.54 | - | - | 0.0% | - | - | - | - | - | - | - | - | - | - | 62.8% | - | - | 78.0% | - | - | - | - | - | - | - | - | - | - | - | - | 3.81 | - | - | - | - | - | - | - | 100.0% | - | - | - | - | - | - | 0.36 | - | 0.78 | 83.3% | - | 54.5% | - | 22.5% | - | 39.6% |
| Claude Sonnet 4.5 Anthropic | 88.0% | 60.8% | 1678elo | 83.4% | 17.8% | 57.3% | 0.0% | 70.7% | 80.4% | 53.4% | 76.5% | 71.4% | 0.0% | 87.5% | 64.0% | 45.7% | 73.3% | 0.0% | - | 0.0% | - | - | 100 | - | 0.0% | 0.0% | 0.0% | 5.0% | - | 0.0% | - | 0.0% | 0.0% | - | 0.0% | 0.0% | 71.4 | 0.0% | 0.0% | 15.2% | 0.0% | 0.0% | 83.9% | 0.0% | 0.0% | 0.0% | - | - | 0.0% | 0.0% | - | 87.5% | 83.8% | 0.0% | 57.0% | 79.3% | 77.6% | 0.75 | 0.75 | 0 | 40.6% | - | 84.5% | 0 | - | 0.0% | 0.0% | 62.9% | 0.0% | 0.0% | 19.0% | 0.0% | 0.0% | 0.0% | 0.0% | 0.0% | 32.9% | - | 0.0% | 0 | 0.0% | 0.0% | 77.2% | 67.0% | 74.8% | - | 0.0% | 0 | 0 | 50.34 | 35.6% | 0 | - | 22.6% | - | - | 0.0% | - | 1.49 | - | 78.1% | 29.2% |
2 / 2 models
| Attribute | Claude Sonnet 4.5 Anthropic | GPT-4o-mini OpenAI |
|---|---|---|
| Description | anthropic/claude-sonnet-4.5 is an AI model. | GPT-4o Mini is an AI model from OpenAI. |
| Family | Claude | GPT |
| Params | Undisclosed (closed) | - |
| Open weights | closed | closed |
| License | proprietary | proprietary |
| Released | 29 Sep 2025 | 18 Jul 2024 |
| Context | 1,000,000 | 128,000 |
| Input $/1M | $3.00 | $0.15 |
| Output $/1M | $15.00 | $0.60 |
| Cache read $/1M | $0.300 | $0.075 |
| Cache write $/1M | $3.750 | - |
| Speed | 0 tok/s | 0 tok/s |
| Latency | 0.00 s | 0.00 s |
| Modalities | text, image, file | text, image, file |
| Providers | anthropic, aws-bedrock, vertex-ai | - |
| Publisher | Anthropic | OpenAI |
| Reported scores | TaxEval v273.3% LiveBench - Math79.3% (LiveBench) LiveBench - Coding80.4% (LiveBench) LiveBench - Language76.5% (LiveBench) LiveBench - Data Analysis57.0% (LiveBench) |
FAQ
- Is Claude Sonnet 4.5 or GPT-4o-mini better?
- Across the 17 benchmarks both models report on Sophon, Claude Sonnet 4.5 leads on 14 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude Sonnet 4.5 and GPT-4o-mini compare on GPQA Diamond?
- Claude Sonnet 4.5 scores 83.4% and GPT-4o-mini scores 42.6% on GPQA Diamond.
- Which is cheaper, Claude Sonnet 4.5 or GPT-4o-mini?
- GPT-4o-mini is cheaper at $0.60 per million output tokens against $15.00 for Claude Sonnet 4.5 - about 25.0x.
- When were Claude Sonnet 4.5 and GPT-4o-mini released?
- Claude Sonnet 4.5 was released 29 Sep 2025 by Anthropic. GPT-4o-mini was released 18 Jul 2024 by OpenAI.
Other head-to-heads
56Claude Sonnet 4.5 vs GPT-4.1 Mini35 shared evalsClaude Opus 4.5 vs Claude Sonnet 4.534 shared evalsClaude Sonnet 4.5 vs GPT-5.232 shared evalsClaude Sonnet 4.5 vs GPT-5 Mini31 shared evalsClaude Sonnet 4.5 vs GPT-531 shared evalsClaude Sonnet 4.5 vs GPT-5 Nano31 shared evalsClaude 4 Sonnet vs Claude Sonnet 4.528 shared evalsClaude Opus 4.6 vs Claude Sonnet 4.528 shared evalsClaude Sonnet 4.5 vs Kimi K2.528 shared evalsClaude Sonnet 4.5 vs Grok 4.1 Fast28 shared evalsClaude Sonnet 4.5 vs Gemini 3.1 Pro Preview27 shared evalsClaude Sonnet 4.5 vs DeepSeek V3.227 shared evalsClaude Sonnet 4.5 vs GPT-5.526 shared evalsClaude Sonnet 4.5 vs GPT-5.426 shared evalsClaude Sonnet 4.5 vs Gemini 2.5 Pro26 shared evalsClaude Opus 4.8 vs Claude Sonnet 4.525 shared evalsClaude Sonnet 4.5 vs GLM 4.725 shared evalsClaude Fable 5 vs Claude Sonnet 4.524 shared evalsClaude Sonnet 4.5 vs Claude Sonnet 4.624 shared evalsClaude Opus 4.7 vs Claude Sonnet 4.524 shared evalsClaude Sonnet 4.5 vs GLM 5.123 shared evalsClaude Sonnet 4.5 vs gpt-oss-120b23 shared evalsClaude Sonnet 4.5 vs GPT-5.4 Mini23 shared evalsGPT-4.1 Mini vs GPT-4o-mini22 shared evalsClaude Sonnet 4.5 vs Qwen3.6 Plus22 shared evalsClaude Sonnet 4.5 vs GPT-4o21 shared evalsGPT-4o vs GPT-4o-mini21 shared evalsClaude Sonnet 4.5 vs GPT-4.119 shared evalsGemini 2.5 Pro vs GPT-4o-mini19 shared evalsGPT-4o-mini vs GPT-5 Mini18 shared evalsClaude 4 Sonnet vs GPT-4o-mini18 shared evalsGPT-4.1 Nano vs GPT-4o-mini17 shared evalsClaude Sonnet 4.5 vs GPT-4.1 Nano16 shared evalsGPT-4o-mini vs GPT-516 shared evalsGPT-4o-mini vs GPT-5 Nano16 shared evalsGPT-4.1 vs GPT-4o-mini16 shared evalsGPT-4o-mini vs GPT-5.215 shared evalsClaude Opus 4.5 vs GPT-4o-mini15 shared evalsDeepSeek V3.2 vs GPT-4o-mini15 shared evalsGPT-4o-mini vs Grok 4.1 Fast15 shared evalsGPT-4o-mini vs gpt-oss-120b15 shared evalsGLM 4.7 vs GPT-4o-mini14 shared evalsGPT-4o-mini vs GPT-5.513 shared evalsGemini 3.1 Pro Preview vs GPT-4o-mini12 shared evalsClaude Opus 4.8 vs GPT-4o-mini12 shared evalsClaude Fable 5 vs GPT-4o-mini12 shared evalsClaude Opus 4.6 vs GPT-4o-mini12 shared evalsGPT-4o-mini vs GPT-5.412 shared evalsGPT-4o-mini vs Kimi K2.512 shared evalsClaude Sonnet 4.6 vs GPT-4o-mini12 shared evalsGLM 5.1 vs GPT-4o-mini12 shared evalsClaude Opus 4.7 vs GPT-4o-mini12 shared evalsGPT-4o-mini vs GPT-5.4 Mini12 shared evalsClaude Sonnet 4.5 vs GPT-6 Astra11 shared evalsGPT-4o-mini vs Qwen3.6 Plus11 shared evalsGPT-4o-mini vs GPT-6 Astra4 shared evals
Comparing something else? Build your own side-by-side.