Claude Sonnet 4.6 vs GPT-5
Head to head on 16 shared benchmarks, with price, context window, and release dates.
Benchmark scores
81evals · sort by any column, ⤢ to expand fullscreen
| Model | ||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Sonnet 4.6 Anthropic | 65.3% | 1805elo | 79.9 | 32.4% | 79.7% | 11.2% | 42.4% | 92.2% | 67.7% | 45.0% | 46.6% | 44.1% | 77.1% | 42.4% | 51.5% | 78.9% | - | - | 87.1% | - | - | - | 47.2% | - | 47.6% | - | - | - | - | 1.35 | 78.0% | - | - | - | 1207elo | 51.0% | - | - | - | - | - | - | - | 78.4% | 80.0% | 76.1% | 63.9% | 77.7% | 86.5% | 86.4% | - | - | - | - | - | - | - | - | - | - | - | - | - | - | 89.3 | - | - | - | 72.1% | - | - | - | - | 76.3 | - | - | 50.6% | 60.6% | - | - | - | 62.8% |
| GPT-5 OpenAI | 61.1% | 1623elo | 72.8 | 32.4% | 68.6% | 6.6% | 45.0% | 83.4% | 65.5% | 18.0% | 43.7% | 37.8% | 73.4% | 12.9% | 20.1% | 0.0% | 46.7% | 91.1% | - | 88.0% | 94.6% | 48.3% | - | 0.0% | - | 0.15 | 0.0% | 68.1% | 4.58 | - | - | 57.7% | 80.0% | 80.0% | - | - | 91.7% | 0.0% | 88.9% | 83.3% | 100.0% | 48.9% | 58.2% | - | - | - | - | - | - | - | 54.3% | 37.5% | 0.52 | 1.62 | 100.0% | 86.1% | 0.0% | 92.7% | 92.7% | 49.6% | 83.7% | 93.3% | 10.0% | 82.0% | - | 0.0% | 60.0% | 0.26 | - | 0.0% | 74.9% | 74.4% | 2.34 | - | 87.5% | 0.86 | - | - | 54.8% | 90.0% | 90.0% | 56.7% |
2 / 2 models
| Attribute | Claude Sonnet 4.6 Anthropic | GPT-5 OpenAI |
|---|---|---|
| Description | Claude Sonnet 4.6 is an AI model from Anthropic. | OpenAI's August 2025 unified frontier model that auto-routes between a fast model and a deeper "thinking" variant. |
| Family | Claude | GPT 5 |
| Params | - | Undisclosed (closed) |
| Open weights | closed | closed |
| License | proprietary | Proprietary |
| Released | 17 Feb 2026 | 7 Aug 2025 |
| Context | 1,000,000 | 400,000 |
| Input $/1M | $3.00 | - |
| Output $/1M | $15.00 | - |
| Cache read $/1M | $0.300 | $0.125 |
| Cache write $/1M | $3.750 | - |
| Speed | 45 tok/s | 0 tok/s |
| Latency | 1.12 s | 0.00 s |
| Modalities | text, image, file | text, image, file |
| Providers | - | openai |
| Publisher | Anthropic | OpenAI |
| Reported scores | GPQA Diamond79.7% (AA) Humanity's Last Exam (HLE)11.2% (AA) IFBench42.4% (AA) SciCode44.1% (AA) τ²-bench (Tau²-bench)78.9% (AA) |
FAQ
- Is Claude Sonnet 4.6 or GPT-5 better?
- Across the 16 benchmarks both models report on Sophon, Claude Sonnet 4.6 leads on 14 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude Sonnet 4.6 and GPT-5 compare on GPQA Diamond?
- Claude Sonnet 4.6 scores 79.7% and GPT-5 scores 68.6% on GPQA Diamond.
- When were Claude Sonnet 4.6 and GPT-5 released?
- Claude Sonnet 4.6 was released 17 Feb 2026 by Anthropic. GPT-5 was released 7 Aug 2025 by OpenAI.
Comparing something else? Build your own side-by-side.