gpt-oss-120b vs Qwen3.6 Plus
Head to head on 16 shared benchmarks, with price, context window, and release dates.
Benchmark scores
48evals · sort by any column, ⤢ to expand fullscreen
| Model | |||||||||||||||||||||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Qwen3.6 Plus Alibaba | 61.9% | 23.0% | 88.2% | 27.8% | 75.2% | 73.5% | 78.2% | 69.9% | 58.3% | 75.0% | 83.7% | 75.8% | 40.7% | 74.7% | 43.9% | 97.7% | - | - | 95.3 | - | - | - | - | 40.8% | 26.2% | - | 96.7 | 83.2% | - | - | - | 36.9% | 77.0% | - | 88.5 | 94.5 | - | 89.5 | 68.0% | 44.9% | - | 73.8 | - | - | 59.5 | 32.0% | 51.5% | 25.6% | 59.0% |
| gpt-oss-120b OpenAI | 58.2% | 13.0% | 67.2% | 5.9% | 58.3% | 51.0% | 60.2% | 38.8% | 50.3% | 48.6% | 68.9% | 39.2% | 36.0% | 71.6% | 5.3% | 45.0% | 41.8% | 66.7% | - | 38.9% | 7.6% | 959elo | 35.8 | - | - | 57.6 | - | - | 70.7% | 1.62 | 1.53 | - | - | 80.0% | - | - | 77.5% | - | - | - | 97.9% | - | 26.0% | 65.6% | - | - | - | - | 49.6% |
2 / 2 models
| Attribute | gpt-oss-120b OpenAI | Qwen3.6 Plus Alibaba |
|---|---|---|
| Description | GPT-Oss 120b is an AI model from OpenAI, released with open weights. | Qwen3.6Plus is an AI model from Alibaba. |
| Family | GPT | Qwen3.6 |
| Params | - | - |
| Open weights | open | closed |
| License | apache-2.0 | proprietary |
| Released | 5 Aug 2025 | 2 Apr 2026 |
| Context | 131,072 | 1,000,000 |
| Input $/1M | $0.15 | $0.50 |
| Output $/1M | $0.60 | $3.00 |
| Cache read $/1M | $0.030 | - |
| Cache write $/1M | - | $0.406 |
| Speed | 186 tok/s | 0 tok/s |
| Latency | 0.50 s | 0.00 s |
| Modalities | text | text, image, video |
| Providers | - | - |
| Publisher | OpenAI | Alibaba |
| Reported scores | GPQA Diamond67.2% (AA) Humanity's Last Exam (HLE)5.9% (AA) LiveCodeBench70.7% (AA) MMLU-Pro77.5% (AA) SciCode36.0% (AA) | GPQA Diamond88.2% (AA) Humanity's Last Exam (HLE)27.8% (AA) IFBench75.2% (AA) SciCode40.7% (AA) τ²-bench (Tau²-bench)97.7% (AA) |
FAQ
- Is gpt-oss-120b or Qwen3.6 Plus better?
- Across the 16 benchmarks both models report on Sophon, Qwen3.6 Plus leads on 16 of them. Which one is "better" depends on the benchmark - the table above shows every shared score.
- How do gpt-oss-120b and Qwen3.6 Plus compare on GPQA Diamond?
- gpt-oss-120b scores 67.2% and Qwen3.6 Plus scores 88.2% on GPQA Diamond.
- Which is cheaper, gpt-oss-120b or Qwen3.6 Plus?
- gpt-oss-120b is cheaper at $0.60 per million output tokens against $3.00 for Qwen3.6 Plus - about 5.0x.
- When were gpt-oss-120b and Qwen3.6 Plus released?
- gpt-oss-120b was released 5 Aug 2025 by OpenAI. Qwen3.6 Plus was released 2 Apr 2026 by Alibaba.
Comparing something else? Build your own side-by-side.