Claude Opus 4.7 vs gpt-oss-120b
Head to head on 18 shared benchmarks, with price, context window, and release dates.
Benchmark scores
48evals · sort by any column, ⤢ to expand fullscreen
| Model | |||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Claude Opus 4.7 Anthropic | 66.1% | 75.0% | 1914elo | 81.8 | 91.4% | 42.3% | 58.6% | 79.7% | 82.1% | 78.3% | 59.3% | 77.9% | 93.1% | 87.7% | 54.5% | 75.3% | 51.5% | 88.6% | - | - | 3.21 | - | - | 1311elo | 51.5% | 43.8% | - | - | - | - | 73.2% | 54.9% | 83.0% | - | - | 91.5 | 70.3% | 45.3% | 100.0% | 54.0% | 56.1% | - | - | - | 72.8 | 56.1% | 67.4% | 71.0% | 68.5% |
| gpt-oss-120b OpenAI | 58.2% | 11.0% | 961elo | 35.8 | 78.2% | 19.6% | 69.0% | 51.0% | 60.2% | 38.8% | 50.3% | 48.6% | 68.9% | 39.2% | 34.0% | 71.6% | 23.5% | 65.8% | 41.8% | 93.4% | - | 38.9% | 7.6% | - | - | - | 57.6 | 87.8% | 1.62 | 1.53 | - | - | - | 80.0% | 80.8% | - | - | - | - | - | - | 97.9% | 26.0% | 65.6% | - | - | - | - | 54.1% |
2 / 2 models
| Attribute | Claude Opus 4.7 Anthropic | gpt-oss-120b OpenAI |
|---|---|---|
| Description | Claude Opus 4.7 is an AI model from Anthropic. | GPT-Oss 120b is an AI model from OpenAI, released with open weights. |
| Family | Claude | GPT |
| Params | - | - |
| Open weights | closed | open |
| License | proprietary | apache-2.0 |
| Released | 16 Apr 2026 | 5 Aug 2025 |
| Context | 1,000,000 | 131,072 |
| Input $/1M | $5.00 | $0.15 |
| Output $/1M | $25.00 | $0.59 |
| Cache read $/1M | $0.500 | $0.075 |
| Cache write $/1M | $6.250 | - |
| Speed | 0 tok/s | 209 tok/s |
| Latency | 0.00 s | 0.51 s |
| Modalities | text, image, file | text |
| Providers | - | - |
| Publisher | Anthropic | OpenAI |
| Reported scores | GPQA Diamond78.2% (AA) Humanity's Last Exam (HLE)19.6% (AA) LiveCodeBench87.8% (AA) MMLU-Pro80.8% (AA) SciCode34.0% (AA) |
FAQ
- Is Claude Opus 4.7 or gpt-oss-120b better?
- Across the 18 benchmarks both models report on Sophon, Claude Opus 4.7 leads on 17 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do Claude Opus 4.7 and gpt-oss-120b compare on GPQA Diamond?
- Claude Opus 4.7 scores 91.4% and gpt-oss-120b scores 78.2% on GPQA Diamond.
- Which is cheaper, Claude Opus 4.7 or gpt-oss-120b?
- gpt-oss-120b is cheaper at $0.59 per million output tokens against $25.00 for Claude Opus 4.7 - about 42.4x.
- When were Claude Opus 4.7 and gpt-oss-120b released?
- Claude Opus 4.7 was released 16 Apr 2026 by Anthropic. gpt-oss-120b was released 5 Aug 2025 by OpenAI.
Other head-to-heads
56Claude Opus 4.7 vs GPT-5.532 shared evalsClaude Opus 4.7 vs Gemini 3.1 Pro Preview31 shared evalsClaude Opus 4.7 vs Claude Opus 4.830 shared evalsClaude Opus 4.6 vs Claude Opus 4.729 shared evalsClaude Opus 4.7 vs Claude Sonnet 4.629 shared evalsClaude Fable 5 vs Claude Opus 4.728 shared evalsClaude Opus 4.7 vs GPT-5.428 shared evalsClaude Opus 4.7 vs Kimi K2.528 shared evalsClaude Opus 4.7 vs GLM 5.128 shared evalsClaude Opus 4.7 vs Qwen3.6 Plus27 shared evalsClaude Opus 4.7 vs GPT-5.226 shared evalsClaude Opus 4.7 vs GPT-5.4 Mini26 shared evalsClaude Opus 4.7 vs GPT-5 Mini25 shared evalsGPT-5 Mini vs gpt-oss-120b25 shared evalsClaude Opus 4.7 vs Claude Sonnet 4.524 shared evalsClaude Opus 4.5 vs Claude Opus 4.724 shared evalsClaude Opus 4.7 vs Grok 4.1 Fast24 shared evalsClaude Sonnet 4.5 vs gpt-oss-120b23 shared evalsClaude Opus 4.7 vs DeepSeek V3.223 shared evalsDeepSeek V3.2 vs gpt-oss-120b23 shared evalsClaude Opus 4.7 vs GPT-5 Nano22 shared evalsGPT-5 Nano vs gpt-oss-120b22 shared evalsGPT-5.2 vs gpt-oss-120b22 shared evalsClaude Opus 4.5 vs gpt-oss-120b21 shared evalsClaude 4 Sonnet vs Claude Opus 4.721 shared evalsClaude 4 Sonnet vs gpt-oss-120b21 shared evalsClaude Opus 4.7 vs GLM 4.721 shared evalsClaude Opus 4.7 vs Gemini 2.5 Pro20 shared evalsgpt-oss-120b vs Grok 4.1 Fast20 shared evalsGLM 4.7 vs gpt-oss-120b20 shared evalsGPT-5.5 vs gpt-oss-120b19 shared evalsClaude Opus 4.6 vs gpt-oss-120b19 shared evalsgpt-oss-120b vs Kimi K2.519 shared evalsGLM 5.1 vs gpt-oss-120b19 shared evalsGemini 2.5 Pro vs gpt-oss-120b19 shared evalsGemini 3.1 Pro Preview vs gpt-oss-120b18 shared evalsClaude Opus 4.8 vs gpt-oss-120b18 shared evalsClaude Fable 5 vs gpt-oss-120b18 shared evalsGPT-5.4 vs gpt-oss-120b18 shared evalsClaude Sonnet 4.6 vs gpt-oss-120b18 shared evalsClaude Opus 4.7 vs GPT-517 shared evalsGPT-5 vs gpt-oss-120b17 shared evalsGPT-4o vs gpt-oss-120b17 shared evalsGPT-5.4 Mini vs gpt-oss-120b17 shared evalsGPT-4.1 vs gpt-oss-120b16 shared evalsgpt-oss-120b vs Qwen3.6 Plus16 shared evalsGPT-4.1 Mini vs gpt-oss-120b15 shared evalsGPT-4o-mini vs gpt-oss-120b15 shared evalsClaude Opus 4.7 vs GPT-6 Astra14 shared evalsClaude Opus 4.7 vs GPT-4o14 shared evalsGPT-4.1 Nano vs gpt-oss-120b14 shared evalsClaude Opus 4.7 vs GPT-4o-mini12 shared evalsClaude Opus 4.7 vs GPT-4.1 Nano12 shared evalsClaude Opus 4.7 vs GPT-4.1 Mini11 shared evalsClaude Opus 4.7 vs GPT-4.111 shared evalsGPT-6 Astra vs gpt-oss-120b6 shared evals
Comparing something else? Build your own side-by-side.