Claude Opus 4.7 vs GPT-4o
Head to head on 14 shared benchmarks, with price, context window, and release dates.
Benchmark scores
54evals · sort by any column, ⤢ to expand fullscreen
| Model | |||||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 Anthropic | 66.1% | 43.8% | 88.5% | 33.3% | 43.6% | 79.7% | 82.1% | 59.3% | 77.9% | 70.3% | 50.1% | 75.3% | 54.5% | 74.0% | - | - | - | - | 3.21 | - | - | 79.0% | - | 1311elo | 1906elo | 81.8 | 51.5% | - | - | 78.3% | 93.1% | 87.7% | - | - | 73.2% | 54.9% | - | 83.0% | - | 91.5 | - | 45.3% | 100.0% | 54.0% | 56.1% | - | - | - | 72.8 | - | 56.1% | 67.4% | 71.0% | - | 67.2% |
| GPT-4o OpenAI | 45.9% | 0.3% | 54.3% | 2.4% | 34.3% | 55.1% | 46.1% | 70.1% | 49.0% | 57.4% | 33.3% | 74.5% | 8.3% | 25.1% | 18.2% | 15.0% | 6.0% | 38 | - | 0.0% | 0.33 | - | 6.1% | - | - | - | - | 96.1 | 0.0% | - | - | - | 30.9% | 75.9% | - | - | 10.8% | - | 74.8% | - | 54.0% | - | - | - | - | 5.71 | 21.6% | 61.2 | - | 0.98 | - | - | - | 32.5% | 33.4% |
2 / 2 models
| Attribute | Claude Opus 4.7 Anthropic | GPT-4o OpenAI |
|---|---|---|
| Description | Claude Opus 4.7 is an AI model from Anthropic. | GPT-4o is an AI model from OpenAI. |
| Family | Claude | GPT |
| Params | - | - |
| Open weights | closed | closed |
| License | proprietary | proprietary |
| Released | 16 Apr 2026 | 20 Nov 2024 |
| Context | 1,000,000 | 128,000 |
| Input $/1M | $5.00 | $2.50 |
| Output $/1M | $25.00 | $10.00 |
| Cache read $/1M | $0.500 | $1.250 |
| Cache write $/1M | $6.250 | - |
| Speed | 0 tok/s | 0 tok/s |
| Latency | 0.00 s | 0.00 s |
| Modalities | text, image, file | text, image, file |
| Providers | - | - |
| Publisher | Anthropic | OpenAI |
| Reported scores | GPQA Diamond88.5% (AA) Humanity's Last Exam (HLE)33.3% (AA) IFBench43.6% (AA) τ²-bench (Tau²-bench)74.0% (AA) Terminal-Bench (Hard)54.5% (AA) | Taubench61.2 pass^1 GSM8K96.1 Accuracy ScholarSearch5.71 Social Sciences & Humanities (%) MortgageTax57.4% AIME202438 pass@1 |
FAQ
- Is Claude Opus 4.7 or GPT-4o better?
- Across the 14 benchmarks both models report on Sophon, Claude Opus 4.7 leads on 13 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude Opus 4.7 and GPT-4o compare on GPQA Diamond?
- Claude Opus 4.7 scores 88.5% and GPT-4o scores 54.3% on GPQA Diamond.
- Which is cheaper, Claude Opus 4.7 or GPT-4o?
- GPT-4o is cheaper at $10.00 per million output tokens against $25.00 for Claude Opus 4.7 - about 2.5x.
- When were Claude Opus 4.7 and GPT-4o released?
- Claude Opus 4.7 was released 16 Apr 2026 by Anthropic. GPT-4o was released 20 Nov 2024 by OpenAI.
Comparing something else? Build your own side-by-side.