Claude 4 Sonnet vs GPT-5.2
Head to head on 25 shared benchmarks, with price, context window, and release dates.
Benchmark scores
58evals · sort by any column, ⤢ to expand fullscreen
| Model | |||||||||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| GPT-5.2 OpenAI | 51.0% | 65.9% | 1699elo | 71.6 | 71.2% | 8.0% | 47.4% | 78.7% | 76.1% | 78.2% | 61.8% | 79.8% | 93.2% | 83.2% | 66.9% | 49.7% | 84.4% | 81.4% | 67.1% | 49.3% | 40.4% | 71.8% | 75.8% | 31.8% | 46.5% | - | 100 | - | 100.0% | 0.0% | 16.7% | - | 60.0% | 40.6% | 9.4% | - | 40.7% | - | 12.93 | 85.0% | 79.0% | 24.0% | - | 72.0% | - | 96.7 | - | 18.7% | 15.0% | - | - | - | 66.7% | - | - | 53.5% | - | - | 56.3% |
| Claude 4 Sonnet Anthropic | 38.0% | 54.7% | 1480elo | 58.4 | 68.3% | 4.3% | 45.4% | 64.8% | 77.5% | 54.6% | 44.3% | 72.9% | 70.5% | 69.0% | 44.9% | 33.9% | 72.4% | 83.7% | 62.5% | 35.0% | 37.3% | 74.6% | 69.6% | 27.3% | 52.3% | 40.7% | - | 22.9% | - | - | - | 47.8% | - | - | - | 19.8% | - | 67.5% | - | - | - | - | 93.4% | - | 86.7% | - | 43.9% | - | - | 6.18 | 6.18 | 58.3% | - | 35.6% | 0.59 | - | 84.0% | 84.0% | 55.5% |
2 / 2 models
| Attribute | Claude 4 Sonnet Anthropic | GPT-5.2 OpenAI |
|---|---|---|
| Description | Claude 4 Sonnet is an AI model from Anthropic. | GPT-5.2 is an AI model from OpenAI. |
| Family | Claude | GPT |
| Params | - | - |
| Open weights | closed | closed |
| License | proprietary | proprietary |
| Released | 22 May 2025 | 11 Dec 2025 |
| Context | 200,000 | 400,000 |
| Input $/1M | $3.00 | $1.75 |
| Output $/1M | $15.00 | $14.00 |
| Cache read $/1M | - | $0.175 |
| Cache write $/1M | - | - |
| Speed | 0 tok/s | 0 tok/s |
| Latency | 0.00 s | 0.00 s |
| Modalities | text, image | file, image, text |
| Providers | - | - |
| Publisher | Anthropic | OpenAI |
| Reported scores |
FAQ
- Is Claude 4 Sonnet or GPT-5.2 better?
- Across the 25 benchmarks both models report on Sophon, GPT-5.2 leads on 21 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude 4 Sonnet and GPT-5.2 compare on GPQA Diamond?
- Claude 4 Sonnet scores 68.3% and GPT-5.2 scores 71.2% on GPQA Diamond.
- Which is cheaper, Claude 4 Sonnet or GPT-5.2?
- GPT-5.2 is cheaper at $14.00 per million output tokens against $15.00 for Claude 4 Sonnet - about 1.1x.
- When were Claude 4 Sonnet and GPT-5.2 released?
- Claude 4 Sonnet was released 22 May 2025 by Anthropic. GPT-5.2 was released 11 Dec 2025 by OpenAI.
Comparing something else? Build your own side-by-side.