GLM 4.7 vs gpt-oss-120b
Head to head on 20 shared benchmarks, with price, context window, and release dates.
Benchmark scores
41evals · sort by any column, ⤢ to expand fullscreen
| Model | ||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| GLM 4.7 Zai | 95.0% | 46.4% | 1413elo | 66 | 85.9% | 27.4% | 67.9% | 60.8% | 73.1% | 55.2% | 35.7% | 65.2% | 76.0% | 59.7% | 89.4% | 85.6% | 45.1% | 68.8% | 31.8% | 95.9% | - | - | - | - | 46.7% | 28.6% | 2.4% | 90.0% | - | 33.3% | - | - | 32.8% | 33.3% | 68.6% | - | 100.0% | 6.0% | - | - | - | 57.4% |
| gpt-oss-120b OpenAI | 93.4% | 58.2% | 961elo | 35.8 | 78.2% | 19.6% | 69.0% | 51.0% | 60.2% | 38.8% | 50.3% | 48.6% | 68.9% | 39.2% | 87.8% | 80.8% | 34.0% | 71.6% | 23.5% | 65.8% | 41.8% | 38.9% | 7.6% | 11.0% | - | - | - | - | 57.6 | - | 1.62 | 1.53 | - | - | - | 80.0% | - | - | 97.9% | 26.0% | 65.6% | 54.1% |
2 / 2 models
| Attribute | GLM 4.7 Zai | gpt-oss-120b OpenAI |
|---|---|---|
| Description | GLM-4.7 is an AI model from Zai, released with open weights. | GPT-Oss 120b is an AI model from OpenAI, released with open weights. |
| Family | Glm | GPT |
| Params | - | - |
| Open weights | open | open |
| License | mit | apache-2.0 |
| Released | 22 Dec 2025 | 5 Aug 2025 |
| Context | 204,800 | 131,072 |
| Input $/1M | $0.60 | $0.15 |
| Output $/1M | $2.20 | $0.59 |
| Cache read $/1M | $0.110 | $0.075 |
| Cache write $/1M | - | - |
| Speed | 0 tok/s | 194 tok/s |
| Latency | 0.00 s | 0.53 s |
| Modalities | text | text |
| Providers | - | - |
| Publisher | Zai | OpenAI |
| Reported scores | GPQA Diamond78.2% (AA) Humanity's Last Exam (HLE)19.6% (AA) LiveCodeBench87.8% (AA) MMLU-Pro80.8% (AA) SciCode34.0% (AA) |
FAQ
- Is GLM 4.7 or gpt-oss-120b better?
- Across the 20 benchmarks both models report on Sophon, GLM 4.7 leads on 16 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do GLM 4.7 and gpt-oss-120b compare on GPQA Diamond?
- GLM 4.7 scores 85.9% and gpt-oss-120b scores 78.2% on GPQA Diamond.
- Which is cheaper, GLM 4.7 or gpt-oss-120b?
- gpt-oss-120b is cheaper at $0.59 per million output tokens against $2.20 for GLM 4.7 - about 3.7x.
- When were GLM 4.7 and gpt-oss-120b released?
- GLM 4.7 was released 22 Dec 2025 by Zai. gpt-oss-120b was released 5 Aug 2025 by OpenAI.
Other head-to-heads
56Claude Sonnet 4.5 vs GLM 4.725 shared evalsGPT-5 Mini vs gpt-oss-120b25 shared evalsGLM 4.7 vs GPT-5 Mini25 shared evalsClaude Opus 4.5 vs GLM 4.725 shared evalsGLM 4.7 vs GPT-5.224 shared evalsGLM 4.7 vs Grok 4.1 Fast24 shared evalsClaude Sonnet 4.5 vs gpt-oss-120b23 shared evalsGLM 4.7 vs GPT-5 Nano23 shared evalsDeepSeek V3.2 vs gpt-oss-120b23 shared evalsGLM 4.7 vs GPT-5.522 shared evalsGPT-5 Nano vs gpt-oss-120b22 shared evalsGPT-5.2 vs gpt-oss-120b22 shared evalsClaude 4 Sonnet vs GLM 4.722 shared evalsGLM 4.7 vs GLM 5.122 shared evalsDeepSeek V3.2 vs GLM 4.722 shared evalsGemini 3.1 Pro Preview vs GLM 4.721 shared evalsClaude Opus 4.8 vs GLM 4.721 shared evalsClaude Opus 4.5 vs gpt-oss-120b21 shared evalsClaude 4 Sonnet vs gpt-oss-120b21 shared evalsClaude Opus 4.6 vs GLM 4.721 shared evalsGLM 4.7 vs GPT-5.421 shared evalsClaude Opus 4.7 vs GLM 4.721 shared evalsClaude Fable 5 vs GLM 4.720 shared evalsGLM 4.7 vs Kimi K2.520 shared evalsGemini 2.5 Pro vs GLM 4.720 shared evalsgpt-oss-120b vs Grok 4.1 Fast20 shared evalsGPT-5.5 vs gpt-oss-120b19 shared evalsClaude Opus 4.6 vs gpt-oss-120b19 shared evalsgpt-oss-120b vs Kimi K2.519 shared evalsClaude Sonnet 4.6 vs GLM 4.719 shared evalsGLM 5.1 vs gpt-oss-120b19 shared evalsGemini 2.5 Pro vs gpt-oss-120b19 shared evalsGLM 4.7 vs GPT-5.4 Mini19 shared evalsGemini 3.1 Pro Preview vs gpt-oss-120b18 shared evalsClaude Opus 4.8 vs gpt-oss-120b18 shared evalsClaude Fable 5 vs gpt-oss-120b18 shared evalsGPT-5.4 vs gpt-oss-120b18 shared evalsClaude Sonnet 4.6 vs gpt-oss-120b18 shared evalsClaude Opus 4.7 vs gpt-oss-120b18 shared evalsGLM 4.7 vs Qwen3.6 Plus18 shared evalsGPT-5 vs gpt-oss-120b17 shared evalsGLM 4.7 vs GPT-517 shared evalsGPT-4o vs gpt-oss-120b17 shared evalsGPT-5.4 Mini vs gpt-oss-120b17 shared evalsGPT-4.1 vs gpt-oss-120b16 shared evalsgpt-oss-120b vs Qwen3.6 Plus16 shared evalsGLM 4.7 vs GPT-4o16 shared evalsGPT-4.1 Mini vs gpt-oss-120b15 shared evalsGPT-4o-mini vs gpt-oss-120b15 shared evalsGLM 4.7 vs GPT-4.1 Mini14 shared evalsGLM 4.7 vs GPT-4o-mini14 shared evalsGPT-4.1 Nano vs gpt-oss-120b14 shared evalsGLM 4.7 vs GPT-4.1 Nano14 shared evalsGLM 4.7 vs GPT-4.113 shared evalsGLM 4.7 vs GPT-6 Astra9 shared evalsGPT-6 Astra vs gpt-oss-120b6 shared evals
Comparing something else? Build your own side-by-side.