benchgap
OpenAI · model

GPT-5 mini benchmark scores

As of 2026-10-07, GPT-5 mini (OpenAI) has measured scores on 1 benchmark and estimated scores on 8 more.

BenchmarkScoreSource
AA-SciCode47.8%estimated ± 3.8 pp, high confidence
AA Coding Index46.4%estimated ± 6.8 pp, medium confidence
SWE-bench Verified74.3%estimated ± 4.4 pp, high confidence
FrontierCode 1.1 Main5.6%estimated ± 4.3 pp, low confidence
Vals SWE-bench69.8%estimated ± 6.3 pp, medium confidence
PostTrainBench v1.119.9%estimated ± 10.5 pp, low confidence
Vibe Code Bench14.2%measured
React Native Evals61.7%estimated ± 3.0 pp, low confidence
SWE-Rebench7.3%estimated ± 6.5 pp, low confidence