Zhipu (GLM) · model
GLM-5 (Reasoning) benchmark scores
As of 2026-10-07, GLM-5 (Reasoning) (Zhipu (GLM)) has measured scores on 1 benchmark and estimated scores on 8 more.
| Benchmark | Score | Source |
|---|---|---|
| AA-SciCode | 49.1% | estimated ± 3.8 pp, high confidence |
| AA Coding Index | 51.4% | estimated ± 6.8 pp, medium confidence |
| SWE-bench Verified | 76.1% | estimated ± 4.4 pp, high confidence |
| FrontierCode 1.1 Main | 9.8% | estimated ± 4.3 pp, low confidence |
| Vals SWE-bench | 73.6% | estimated ± 6.3 pp, medium confidence |
| PostTrainBench v1.1 | 19.9% | estimated ± 10.5 pp, low confidence |
| Vibe Code Bench | 23.4% | measured |
| React Native Evals | 71.2% | estimated ± 3.0 pp, low confidence |
| SWE-Rebench | 45.2% | estimated ± 6.5 pp, low confidence |