Claude 4 Sonnet vs DeepSeek V3.2
Head to head on 21 shared benchmarks, with price, context window, and release dates.
Benchmark scores
52evals · sort by any column, ⤢ to expand fullscreen
| Model | |||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude 4 Sonnet Anthropic | 74.3% | 54.7% | 1483elo | 58.4 | 77.7% | 10.7% | 54.7% | 64.8% | 77.5% | 54.6% | 44.3% | 72.9% | 70.5% | 69.0% | 65.5% | 84.2% | 40.0% | 74.6% | 69.6% | 31.1% | 64.6% | - | - | 77.3% | 22.9% | 47.8% | - | - | 19.8% | - | 67.5% | - | - | 99.1% | - | 33.9% | 72.4% | 86.7% | 62.5% | 43.9% | - | 6.18 | 6.18 | 35.0% | 58.3% | - | 35.6% | - | 0.59 | - | 84.0% | 84.0% | 59.6% |
| DeepSeek V3.2 DeepSeek | 92.0% | 47.9% | 1515elo | 66.8 | 84.0% | 24.6% | 60.7% | 65.9% | 64.6% | 50.0% | 48.2% | 70.4% | 85.0% | 77.2% | 86.2% | 86.2% | 38.9% | 70.0% | 68.2% | 35.6% | 90.6% | 74.7% | 74.2% | - | - | - | 0.0% | 13.0% | - | 22.1% | - | 31.3% | 68.0% | - | 57.5% | - | - | - | - | - | 8.0% | - | - | - | - | 59.0% | - | 65 | - | 5.1% | - | - | 55.3% |
2 / 2 models
| Attribute | Claude 4 Sonnet Anthropic | DeepSeek V3.2 DeepSeek |
|---|---|---|
| Description | Claude 4 Sonnet is an AI model from Anthropic. | DeepSeek V3.2 is an AI model from DeepSeek, released with open weights. |
| Family | Claude | Deepseek |
| Params | - | - |
| Open weights | closed | open |
| License | proprietary | mit |
| Released | 22 May 2025 | 1 Dec 2025 |
| Context | 200,000 | 163,840 |
| Input $/1M | - | $0.28 |
| Output $/1M | - | $0.42 |
| Cache read $/1M | - | $0.140 |
| Cache write $/1M | - | - |
| Speed | 0 tok/s | 0 tok/s |
| Latency | 0.00 s | 0.00 s |
| Modalities | text, image | text |
| Providers | - | - |
| Publisher | Anthropic | DeepSeek |
| Reported scores | Aider Polyglot Benchmark74.2% (Aider) MathArena57.47% GPQA Diamond84.0% (AA) Humanity's Last Exam (HLE)24.6% (AA) |
FAQ
- Is Claude 4 Sonnet or DeepSeek V3.2 better?
- Across the 21 benchmarks both models report on Sophon, DeepSeek V3.2 leads on 14 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude 4 Sonnet and DeepSeek V3.2 compare on GPQA Diamond?
- Claude 4 Sonnet scores 77.7% and DeepSeek V3.2 scores 84.0% on GPQA Diamond.
- When were Claude 4 Sonnet and DeepSeek V3.2 released?
- Claude 4 Sonnet was released 22 May 2025 by Anthropic. DeepSeek V3.2 was released 1 Dec 2025 by DeepSeek.
Other head-to-heads
56Claude 4 Sonnet vs GPT-5 Mini29 shared evalsDeepSeek V3.2 vs GPT-5.229 shared evalsClaude 4 Sonnet vs Claude Sonnet 4.528 shared evalsClaude Sonnet 4.5 vs DeepSeek V3.227 shared evalsClaude Opus 4.5 vs DeepSeek V3.227 shared evalsDeepSeek V3.2 vs GPT-5 Mini26 shared evalsClaude 4 Sonnet vs Claude Opus 4.526 shared evalsClaude Opus 4.6 vs DeepSeek V3.226 shared evalsDeepSeek V3.2 vs Grok 4.1 Fast26 shared evalsClaude 4 Sonnet vs GPT-525 shared evalsClaude 4 Sonnet vs GPT-5 Nano25 shared evalsClaude 4 Sonnet vs GPT-5.225 shared evalsClaude 4 Sonnet vs Gemini 2.5 Pro25 shared evalsDeepSeek V3.2 vs Kimi K2.525 shared evalsDeepSeek V3.2 vs Gemini 3.1 Pro Preview24 shared evalsClaude 4 Sonnet vs Grok 4.1 Fast24 shared evalsDeepSeek V3.2 vs GPT-5.424 shared evalsDeepSeek V3.2 vs GLM 5.124 shared evalsClaude 4 Sonnet vs GPT-5.523 shared evalsDeepSeek V3.2 vs GPT-5.523 shared evalsClaude 4 Sonnet vs Gemini 3.1 Pro Preview23 shared evalsClaude 4 Sonnet vs Kimi K2.523 shared evalsClaude Sonnet 4.6 vs DeepSeek V3.223 shared evalsClaude Opus 4.7 vs DeepSeek V3.223 shared evalsDeepSeek V3.2 vs gpt-oss-120b23 shared evalsDeepSeek V3.2 vs GPT-5 Nano22 shared evalsClaude 4 Sonnet vs Claude Opus 4.822 shared evalsClaude Opus 4.8 vs DeepSeek V3.222 shared evalsClaude 4 Sonnet vs Claude Fable 522 shared evalsClaude 4 Sonnet vs GPT-5.422 shared evalsClaude 4 Sonnet vs Claude Opus 4.622 shared evalsClaude 4 Sonnet vs GLM 4.722 shared evalsDeepSeek V3.2 vs GLM 4.722 shared evalsDeepSeek V3.2 vs GPT-5.4 Mini22 shared evalsClaude 4 Sonnet vs Claude Opus 4.721 shared evalsClaude 4 Sonnet vs gpt-oss-120b21 shared evalsDeepSeek V3.2 vs Gemini 2.5 Pro21 shared evalsClaude Fable 5 vs DeepSeek V3.220 shared evalsClaude 4 Sonnet vs Claude Sonnet 4.620 shared evalsClaude 4 Sonnet vs GLM 5.120 shared evalsClaude 4 Sonnet vs GPT-4o20 shared evalsDeepSeek V3.2 vs Qwen3.6 Plus20 shared evalsClaude 4 Sonnet vs GPT-4.1 Mini19 shared evalsDeepSeek V3.2 vs GPT-519 shared evalsClaude 4 Sonnet vs GPT-4.119 shared evalsClaude 4 Sonnet vs Qwen3.6 Plus19 shared evalsClaude 4 Sonnet vs GPT-5.4 Mini19 shared evalsClaude 4 Sonnet vs GPT-4o-mini18 shared evalsDeepSeek V3.2 vs GPT-4o18 shared evalsClaude 4 Sonnet vs GPT-4.1 Nano16 shared evalsDeepSeek V3.2 vs GPT-4.1 Mini15 shared evalsDeepSeek V3.2 vs GPT-4.115 shared evalsDeepSeek V3.2 vs GPT-4o-mini15 shared evalsDeepSeek V3.2 vs GPT-4.1 Nano15 shared evalsDeepSeek V3.2 vs GPT-6 Astra9 shared evalsClaude 4 Sonnet vs GPT-6 Astra8 shared evals
Comparing something else? Build your own side-by-side.