benchgap
Zhipu (GLM) · model

GLM-5 (Reasoning) benchmark scores

As of 2026-10-07, GLM-5 (Reasoning) (Zhipu (GLM)) has measured scores on 1 benchmark and estimated scores on 8 more.

BenchmarkScoreSource
AA-SciCode49.1%estimated ± 3.8 pp, high confidence
AA Coding Index51.4%estimated ± 6.8 pp, medium confidence
SWE-bench Verified76.1%estimated ± 4.4 pp, high confidence
FrontierCode 1.1 Main9.8%estimated ± 4.3 pp, low confidence
Vals SWE-bench73.6%estimated ± 6.3 pp, medium confidence
PostTrainBench v1.119.9%estimated ± 10.5 pp, low confidence
Vibe Code Bench23.4%measured
React Native Evals71.2%estimated ± 3.0 pp, low confidence
SWE-Rebench45.2%estimated ± 6.5 pp, low confidence