GLM 4.7 vs GPT-4.1
Head to head on 13 shared benchmarks, with price, context window, and release dates.
Benchmark scores
55evals · sort by any column, ⤢ to expand fullscreen
| Model | ||||||||||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| GLM 4.7 Zai | 48.0% | 46.4% | 1411elo | 2.4% | 66.4% | 6.4% | 54.6% | 56.2% | 79.4% | 35.4% | 68.8% | 30.3% | 94.2% | - | - | - | - | - | - | - | - | - | 46.7% | 66 | 28.6% | - | 90.0% | 60.8% | 73.1% | 55.2% | 35.7% | 65.2% | 76.0% | 59.7% | 33.3% | - | - | - | - | - | - | 32.8% | 33.3% | - | 68.6% | - | - | 100.0% | 6.0% | - | - | - | - | - | - | 51.9% |
| GPT-4.1 OpenAI | 34.7% | 63.1% | 1417elo | 5.5% | 66.6% | 4.2% | 43.0% | 45.7% | 80.6% | 38.1% | 75.1% | 13.6% | 47.1% | 0.0% | 52.4% | 43.7% | 26.7% | 61.5% | 1.64 | 83.7% | 1.55 | 12.4% | - | - | - | 60.9% | - | - | - | - | - | - | - | - | - | 70.8% | 0.49 | 0.49 | 91.3% | 32.1% | 32.1% | - | - | 69.4% | - | 50.5% | 65.9% | - | - | 8.57 | 31.1% | 39.6% | 10.0% | 92.0% | 92.0% | 48.0% |
2 / 2 models
| Attribute | GLM 4.7 Zai | GPT-4.1 OpenAI |
|---|---|---|
| Description | GLM-4.7 is an AI model from Zai, released with open weights. | GPT-4.1 is an AI model from OpenAI. |
| Family | Glm | GPT |
| Params | - | - |
| Open weights | open | closed |
| License | mit | proprietary |
| Released | 22 Dec 2025 | 14 Apr 2025 |
| Context | 204,800 | 1,047,576 |
| Input $/1M | $0.60 | $2.00 |
| Output $/1M | $2.20 | $8.00 |
| Cache read $/1M | $0.080 | $0.500 |
| Cache write $/1M | - | - |
| Speed | 0 tok/s | 0 tok/s |
| Latency | 0.00 s | 0.00 s |
| Modalities | text | image, text, file |
| Providers | - | - |
| Publisher | Zai | OpenAI |
| Reported scores | ScholarSearch8.57 Social Sciences & Humanities (%) GPQA Diamond66.6% (AA) Humanity's Last Exam (HLE)4.2% (AA) IFBench43.0% (AA) |
FAQ
- Is GLM 4.7 or GPT-4.1 better?
- Across the 13 benchmarks both models report on Sophon, GPT-4.1 leads on 7 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do GLM 4.7 and GPT-4.1 compare on GPQA Diamond?
- GLM 4.7 scores 66.4% and GPT-4.1 scores 66.6% on GPQA Diamond.
- Which is cheaper, GLM 4.7 or GPT-4.1?
- GLM 4.7 is cheaper at $2.20 per million output tokens against $8.00 for GPT-4.1 - about 3.6x.
- When were GLM 4.7 and GPT-4.1 released?
- GLM 4.7 was released 22 Dec 2025 by Zai. GPT-4.1 was released 14 Apr 2025 by OpenAI.
Comparing something else? Build your own side-by-side.