benchgap
Other · model

Laguna XS 2.1 benchmark scores

As of 2026-10-07, Laguna XS 2.1 (Other) has measured scores on 4 benchmarks and estimated scores on 22 more.

BenchmarkScoreSource
AA-SciCode43.9%estimated ± 3.8 pp, high confidence
LiveCodeBench v683.9%estimated ± 2.1 pp, high confidence
SciCode44.2%estimated ± 3.8 pp, high confidence
AA Coding Index42.7%estimated ± 5.1 pp, medium confidence
SWE-bench Verified70.9%measured
SWE-bench Pro47.6%measured
CursorBench 3.145.9%estimated ± 5.6 pp, low confidence
CursorBench 3.234.7%estimated ± 3.6 pp, medium confidence
FrontierCode 1.1 Main4.5%estimated ± 2.7 pp, low confidence
FrontierSWE v20.0%estimated ± 9.0 pp, low confidence
Vals LiveCodeBench73.7%estimated ± 4.7 pp, medium confidence
Vals SWE-bench63.8%estimated ± 6.8 pp, medium confidence
Terminal-Bench 2.1 (Vals AI)32.6%estimated ± 6.3 pp, medium confidence
CursorBench 4.026.0%estimated ± 3.6 pp, medium confidence
PostTrainBench v1.118.7%estimated ± 4.7 pp, medium confidence
SWE Multilingual63.1%measured
Vibe Code Bench0.7%estimated ± 8.1 pp, medium confidence
MMLU-ProX80.1%estimated ± 1.7 pp, low confidence
NL2Repo29.5%estimated ± 6.1 pp, medium confidence
NOVA-6351.6%estimated ± 1.6 pp, low confidence
Terminal-Bench 2.037.5%measured
LiveCodeBench Pro73.2%estimated ± 6.0 pp, low confidence
SWE-Rebench57.0%estimated ± 3.6 pp, medium confidence
FrontierCode 1.1 Extended51.3%estimated ± 3.0 pp, low confidence
LiveCodeBench80.6%estimated ± 10.2 pp, low confidence
OpenHarmony Bench53.3%estimated ± 4.9 pp, low confidence