Claude Opus 4.8 vs GPT-5
Head to head on 17 shared benchmarks, with price, context window, and release dates.
Benchmark scores
87evals · sort by any column, ⤢ to expand fullscreen
| Model | ||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.8 Anthropic | 66.7% | 1840elo | 80.8 | 47.2% | 92.0% | 48.7% | 62.2% | 53.2% | 85.8% | 69.9% | 69.0% | 54.8% | 53.5% | 75.6% | 58.3% | 82.7% | 94.4% | - | - | - | - | - | - | 15.5% | - | 80.4% | 14.5% | - | - | - | 62.0% | - | - | - | 1281elo | 40.0% | 53.9% | - | 13.4% | 22.5% | - | 1890elo | - | - | - | 56.9% | - | - | 10.4% | - | 80.1% | 79.3% | 78.3% | 67.4% | 81.4% | 84.3% | 89.7% | - | - | - | - | - | - | 91.8% | - | - | - | - | - | - | - | - | - | 83.4% | - | - | - | 69.2% | - | 82.7% | - | - | 55.1% | 70.9% | - | - | - | 63.1% |
| GPT-5 OpenAI | 61.1% | 1627elo | 72.8 | 32.4% | 85.4% | 28.5% | 73.1% | 49.6% | 83.7% | 65.5% | 18.0% | 43.7% | 42.9% | 73.4% | 32.6% | 20.1% | 84.8% | 46.7% | 91.1% | 88.0% | 94.6% | 94.3% | 0.0% | - | 0.15 | - | - | 0.0% | 68.1% | 4.58 | - | 57.7% | 80.0% | 80.0% | - | - | - | 91.7% | - | - | 0.0% | - | 88.9% | 83.3% | 100.0% | - | 48.9% | 83.4% | - | 58.2% | - | - | - | - | - | - | - | 84.6% | 37.5% | 0.52 | 1.62 | 100.0% | 99.4% | - | 0.0% | 92.7% | 92.7% | 93.3% | 10.0% | 87.1% | 0.0% | 60.0% | 0.26 | - | 0.0% | 74.9% | 74.4% | - | 2.34 | - | 87.5% | 0.86 | - | - | 54.8% | 90.0% | 90.0% | 61.9% |
2 / 2 models
| Attribute | Claude Opus 4.8 Anthropic | GPT-5 OpenAI |
|---|---|---|
| Description | Claude Opus 4.8 (Adaptive Reasoning, Max Effort) is an AI model from Anthropic. | OpenAI's August 2025 unified frontier model that auto-routes between a fast model and a deeper "thinking" variant. |
| Family | Claude | GPT 5 |
| Params | - | Undisclosed (closed) |
| Open weights | - | closed |
| License | - | proprietary |
| Released | 28 May 2026 | 7 Aug 2025 |
| Context | 1,000,000 | 400,000 |
| Input $/1M | $5.00 | $1.25 |
| Output $/1M | $25.00 | $10.00 |
| Cache read $/1M | $0.500 | $0.125 |
| Cache write $/1M | $6.250 | - |
| Speed | 0 tok/s | 0 tok/s |
| Latency | 0.00 s | 0.00 s |
| Modalities | text, image, file | text, image, file |
| Providers | - | openai |
| Publisher | Anthropic | OpenAI |
| Reported scores | SWE-bench74.9% (Verified) GPQA Diamond85.4% (AA) Humanity's Last Exam (HLE)28.5% (AA) IFBench73.1% (AA) |
FAQ
- Is Claude Opus 4.8 or GPT-5 better?
- Across the 17 benchmarks both models report on Sophon, Claude Opus 4.8 leads on 16 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude Opus 4.8 and GPT-5 compare on GPQA Diamond?
- Claude Opus 4.8 scores 92.0% and GPT-5 scores 85.4% on GPQA Diamond.
- Which is cheaper, Claude Opus 4.8 or GPT-5?
- GPT-5 is cheaper at $10.00 per million output tokens against $25.00 for Claude Opus 4.8 - about 2.5x.
- When were Claude Opus 4.8 and GPT-5 released?
- Claude Opus 4.8 was released 28 May 2026 by Anthropic. GPT-5 was released 7 Aug 2025 by OpenAI.
Other head-to-heads
56GPT-4.1 Mini vs GPT-541 shared evalsClaude Opus 4.8 vs GPT-5.541 shared evalsClaude Fable 5 vs Claude Opus 4.840 shared evalsClaude Opus 4.8 vs Gemini 3.1 Pro Preview38 shared evalsGPT-5 vs GPT-5 Mini36 shared evalsClaude Sonnet 4.5 vs GPT-531 shared evalsClaude Opus 4.7 vs Claude Opus 4.830 shared evalsClaude Opus 4.8 vs Claude Sonnet 4.629 shared evalsGPT-5 vs GPT-5 Nano28 shared evalsGPT-4.1 vs GPT-528 shared evalsClaude Opus 4.6 vs Claude Opus 4.828 shared evalsClaude Opus 4.8 vs GPT-5.428 shared evalsClaude Opus 4.8 vs Kimi K2.528 shared evalsClaude Opus 4.8 vs GLM 5.127 shared evalsClaude Opus 4.8 vs GPT-5.226 shared evalsClaude Opus 4.8 vs GPT-5.4 Mini26 shared evalsClaude Opus 4.8 vs Claude Sonnet 4.525 shared evalsClaude 4 Sonnet vs GPT-525 shared evalsClaude Opus 4.8 vs Qwen3.6 Plus25 shared evalsClaude Opus 4.8 vs GPT-5 Mini24 shared evalsGemini 2.5 Pro vs GPT-524 shared evalsClaude Opus 4.5 vs Claude Opus 4.824 shared evalsClaude Opus 4.8 vs Grok 4.1 Fast24 shared evalsGPT-5 vs GPT-5.223 shared evalsClaude Opus 4.5 vs GPT-523 shared evalsClaude Opus 4.8 vs GPT-5 Nano22 shared evalsClaude 4 Sonnet vs Claude Opus 4.822 shared evalsClaude Opus 4.8 vs DeepSeek V3.222 shared evalsGPT-4.1 Nano vs GPT-521 shared evalsClaude Opus 4.8 vs GLM 4.721 shared evalsGPT-5 vs Grok 4.1 Fast20 shared evalsClaude Opus 4.8 vs Gemini 2.5 Pro20 shared evalsGemini 3.1 Pro Preview vs GPT-519 shared evalsClaude Opus 4.6 vs GPT-519 shared evalsGPT-5 vs GPT-5.419 shared evalsDeepSeek V3.2 vs GPT-519 shared evalsGPT-4o vs GPT-519 shared evalsClaude Opus 4.8 vs GPT-6 Astra19 shared evalsGPT-5 vs GPT-5.518 shared evalsGPT-5 vs Kimi K2.518 shared evalsClaude Opus 4.8 vs gpt-oss-120b18 shared evalsClaude Opus 4.7 vs GPT-517 shared evalsGPT-5 vs gpt-oss-120b17 shared evalsGLM 4.7 vs GPT-517 shared evalsClaude Fable 5 vs GPT-516 shared evalsGPT-4o-mini vs GPT-516 shared evalsClaude Sonnet 4.6 vs GPT-516 shared evalsGLM 5.1 vs GPT-516 shared evalsGPT-5 vs GPT-5.4 Mini16 shared evalsGPT-5 vs Qwen3.6 Plus15 shared evalsClaude Opus 4.8 vs GPT-4o14 shared evalsGPT-5 vs GPT-6 Astra12 shared evalsClaude Opus 4.8 vs GPT-4o-mini12 shared evalsClaude Opus 4.8 vs GPT-4.1 Nano12 shared evalsClaude Opus 4.8 vs GPT-4.1 Mini11 shared evalsClaude Opus 4.8 vs GPT-4.111 shared evals
Comparing something else? Build your own side-by-side.