Claude Opus 4.6 vs GPT-4o-mini
Head to head on 12 shared benchmarks, with price, context window, and release dates.
Benchmark scores
63evals · sort by any column, ⤢ to expand fullscreen
| Model | ||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.6 Anthropic | 67.0% | 1804elo | 84.0% | 19.1% | 44.6% | 78.8% | 78.2% | 63.3% | 83.3% | 68.5% | 45.7% | 76.0% | - | - | - | - | 99.79 | - | 56.1% | 1.5 | - | - | 2.08 | 71.0% | - | 1223elo | 77.7 | 40.7% | - | - | - | 84.9% | 88771 | 58 | - | 69.9% | 89.3% | 88.7% | - | - | 78.5% | 48.2% | - | 86.7% | - | - | 93 | 50.0% | 51.6% | - | 44.5 | 72.0% | 75.6% | - | 48.5% | 80.6 | - | 57.6% | - | - | - | - | 84.8% | 66.5% |
| GPT-4o-mini OpenAI | 45.5% | 871elo | 42.6% | 4.2% | 31.0% | 47.2% | 43.0% | 65.8% | 32.9% | 54.5% | 22.9% | 60.5% | 16.7% | 3.6% | 11.7% | 14.7% | - | 50.7% | - | - | 0.29 | 0.0% | - | - | 0.0% | - | - | - | 0.0% | 1.54 | 0.0% | - | - | - | 72.0% | - | - | - | 23.4% | 78.9% | - | - | 62.8% | - | 64.8% | 78.0% | - | - | - | 3.81 | - | - | - | 100.0% | - | - | 0.36 | - | 0.78 | 83.3% | 54.5% | 22.5% | - | 39.6% |
2 / 2 models
| Attribute | Claude Opus 4.6 Anthropic | GPT-4o-mini OpenAI |
|---|---|---|
| Description | Claude Opus 4.6 is an AI model from Anthropic. | GPT-4o Mini is an AI model from OpenAI. |
| Family | Claude | GPT |
| Params | - | - |
| Open weights | closed | closed |
| License | proprietary | proprietary |
| Released | 5 Feb 2026 | 18 Jul 2024 |
| Context | 1,000,000 | 128,000 |
| Input $/1M | $5.00 | $0.15 |
| Output $/1M | $25.00 | $0.60 |
| Cache read $/1M | $0.500 | $0.075 |
| Cache write $/1M | $6.250 | - |
| Speed | 0 tok/s | 0 tok/s |
| Latency | 0.00 s | 0.00 s |
| Modalities | text, image, file | text, image, file |
| Providers | - | - |
| Publisher | Anthropic | OpenAI |
| Reported scores | GPQA Diamond84.0% (AA) Humanity's Last Exam (HLE)19.1% (AA) SciCode45.7% (AA) τ²-bench (Tau²-bench)84.8% (AA) Terminal-Bench (Hard)48.5% (AA) |
FAQ
- Is Claude Opus 4.6 or GPT-4o-mini better?
- Across the 12 benchmarks both models report on Sophon, Claude Opus 4.6 leads on 11 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude Opus 4.6 and GPT-4o-mini compare on GPQA Diamond?
- Claude Opus 4.6 scores 84.0% and GPT-4o-mini scores 42.6% on GPQA Diamond.
- Which is cheaper, Claude Opus 4.6 or GPT-4o-mini?
- GPT-4o-mini is cheaper at $0.60 per million output tokens against $25.00 for Claude Opus 4.6 - about 41.7x.
- When were Claude Opus 4.6 and GPT-4o-mini released?
- Claude Opus 4.6 was released 5 Feb 2026 by Anthropic. GPT-4o-mini was released 18 Jul 2024 by OpenAI.
Comparing something else? Build your own side-by-side.