Codesota · Models · GLM-4.5Zhipu AI14 results · 8 benchmarks
Model card

GLM-4.5.

Zhipu AIopen-source
§ 02 · Benchmarks

Every benchmark GLM-4.5 has a recorded score for.

#BenchmarkArea · TaskMetricValueRankDateSource
01SimpleQANatural Language Processing · Question Answeringaccuracy26.4%#4/7—source ↗
02LiveCodeBenchComputer Code · Code Generationpass-172.9%#14/24—source ↗
03BrowseCompNatural Language Processing · Question Answeringaccuracy26.4%#15/16—source ↗
04MMLUReasoning · Commonsense Reasoningaccuracy90.0%#15/64—source ↗
05SWE-Bench VerifiedComputer Code · Code Generationaccuracy64.2%#18/22—source ↗
06GPQA DiamondReasoning · Multi-step Reasoningaccuracy79.1%#33/74—source ↗
07HLEReasoning · Multi-step Reasoningaccuracy14.4%#43/74—source ↗
08PLCCNatural Language Processing · Polish Cultural Competencygeography79.0%#61/165—source ↗
09PLCCNatural Language Processing · Polish Cultural Competencyhistory77.0%#69/165—source ↗
10PLCCNatural Language Processing · Polish Cultural Competencyculture-and-tradition68.0%#70/165—source ↗
11PLCCNatural Language Processing · Polish Cultural Competencyvocabulary60.0%#73/165—source ↗
12PLCCNatural Language Processing · Polish Cultural Competencyaverage66.5%#74/165—source ↗
13PLCCNatural Language Processing · Polish Cultural Competencyart-and-entertainment56.0%#74/165—source ↗
14PLCCNatural Language Processing · Polish Cultural Competencygrammar59.0%#82/165—source ↗
Rank column shows this model’s position vs all other models scored on the same benchmark + metric (competitors after the slash). #1 in red means current SOTA. Sorted by rank, then newest result.
§ 03 · Strengths by area

Where GLM-4.5 actually performs.

Computer Code
2
benchmarks
avg rank #16.0
Reasoning
3
benchmarks
avg rank #30.3
Natural Language Processing
3
benchmarks
avg rank #58.0
§ 04 · Papers

1 paper with results for GLM-4.5.

  1. 2025-08-08· 7 results

    GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models

§ 05 · Related models

Other Zhipu AI models scored on Codesota.

GLM-5
130B params · 19 results
GLM-4.5-Air
13 results
GLM-4.7
9 results
GLM-4.6
7 results
GLM-4.7-Flash
7 results
GLM-OCR
3 results
GLM-4.5
2 results
GLM-4.5-Air
2 results
§ 06 · Sources & freshness

Where these numbers come from.

pwc-dump
7
results
sdadas/PLCC
7
results
7 of 14 rows marked verified.