Request a pilot
‹ PublicAI Index

The LLM benchmark aggregator.

GLM-5

Z.ai · 754B · open weights

Strongest in Core abilities (#20 of 204, on 1 of its 3 boards), weakest in Safety (#183 of 337). Above par in 12 of 18 scopes. Among the models it meets almost everywhere, it finishes behind GPT-5.5 and Claude Fable 5 and ahead of O3 and O1.

§ 1 · Profile

What it is good at

Bars run from 50 — the average of the models each source lists — so right of the line is above par. The middle column is the gap to whoever leads that scope.

Core abilities57.6#20/204
General intelligence60.9#21/204
Human preference62.5#50/342
Human preference62.5#50/342
Knowledge55#54/138
Academic knowledge56#50/123
Professional51.7#64/168
Medical55.7#31/140
Finance52.7#71/151
Legal48.6#89/151
Reasoning52.4#72/178
Mathematics56.8#32/140
Science55.1#58/122
Reasoning47.5#71/140
Coding47#99/165
Agentic coding46.6#93/157
Safety49.9#183/337
Factual grounding49.7#57/101

§ 2 · Head to head

What it beats, and what beats it

The same models turn up scope after scope. Counted once: where both were placed, who finished higher. Bars run right for GLM-5, left for the other.

Grok 2won 11 · lost 0
Mistral Medium 3.5won 15 · lost 0
MiniMax M2.5won 16 · lost 0
Mistral Large 3won 17 · lost 1
GPT-4.1 Nanowon 16 · lost 1
GPT-4o Miniwon 15 · lost 1
Llama 4 Scout Instructwon 15 · lost 1
GPT-5 Nanowon 15 · lost 1
GPT OSS 20Bwon 13 · lost 1
Mistral Smallwon 13 · lost 1
GLM-4.5won 13 · lost 1
Nemotron 3 Ultrawon 12 · lost 1
Claude 3.5 Haikuwon 12 · lost 1
Gemini 1.5 Prowon 12 · lost 1
Command R Pluswon 11 · lost 1
Gemini 1.5 Flashwon 10 · lost 1
GPT OSS 120Bwon 16 · lost 2
GPT-5.4 Nanowon 16 · lost 2
Claude Haiku 4.5won 16 · lost 2
Command Awon 15 · lost 2
Gemini 2.0 Flashwon 15 · lost 2
DeepSeek R1won 15 · lost 2
Grok 4.3won 15 · lost 2
GPT-5.4 Miniwon 15 · lost 2
Gemini 3.5 Flash Litewon 14 · lost 2
Mimo V2.5won 11 · lost 2
Mistral Largewon 10 · lost 2
DeepSeek V3won 15 · lost 3
DeepSeek V3.2won 15 · lost 3
Ling 3.0 Flashwon 9 · lost 2
DeepSeek V3.1won 9 · lost 2
Kimi K2 Thinkingwon 12 · lost 3
Gemini 2.5 Flash Litewon 12 · lost 3
MiniMax M2.7won 11 · lost 3
Gemma 4 31Bwon 11 · lost 3
GPT-5 Miniwon 14 · lost 4
Claude Sonnet 4won 14 · lost 4
Grok 4 Fastwon 14 · lost 4
Kimi K2won 14 · lost 4
GPT-4.1 Miniwon 13 · lost 4
GLM-4.6won 13 · lost 4
GPT-4owon 12 · lost 4
Grok 3won 12 · lost 4
Qwen3.6 Pluswon 12 · lost 4
Mimo V2.5 Prowon 12 · lost 4
O3 Miniwon 11 · lost 4
Grok 3 Miniwon 11 · lost 4
Qwen3.5 Flashwon 11 · lost 4
Qwen3 Maxwon 11 · lost 4
O4 Miniwon 13 · lost 5
Kimi K2.5won 13 · lost 5
Claude 3.5 Sonnetwon 10 · lost 4
MiniMax M2.1won 10 · lost 4
GPT-6 Lunawon 10 · lost 4
Qwen3 235B A22B Instructwon 12 · lost 5
Gemini 3.1 Flash Litewon 12 · lost 5
MiniMax M3won 12 · lost 5
Grok 4.1 Fastwon 11 · lost 5
Gemini 2.5 Flashwon 12 · lost 6
Grok 4won 11 · lost 6
GPT-4.1won 11 · lost 7
Inklingwon 10 · lost 7
Inkling Smallwon 8 · lost 6
GLM-4.7won 8 · lost 6
Claude Opus 4.1won 8 · lost 6
Qwen3.8 27Bwon 9 · lost 7
Claude Opus 4won 10 · lost 8
Gemini 2.5 Prowon 10 · lost 8
Claude 3.7 Sonnetwon 8 · lost 7
O1won 8 · lost 7
O3won 9 · lost 8
Kimi K2.6won 9 · lost 9
DeepSeek V4 Flashwon 8 · lost 9
Qwen3.7 Maxwon 8 · lost 9
DeepSeek V4won 5 · lost 6
Claude Sonnet 4.5won 8 · lost 10
Grok 4.20won 6 · lost 8
GLM-5.2won 7 · lost 10
Claude Opus 4.5won 7 · lost 11
Qwen 3.5 Pluswon 5 · lost 8
Grok 4.6won 6 · lost 11
GPT-5.6 Lunawon 6 · lost 11
GPT-6 Solwon 5 · lost 10
Gemini 3.1 Prowon 6 · lost 12
GPT-5.1won 5 · lost 11
Gemini 3 Flashwon 5 · lost 11
GLM-5.3 Flashwon 5 · lost 12
Grok 4.7won 4 · lost 10
GPT-5won 5 · lost 13
GPT-5.2won 5 · lost 13
Claude Sonnet 4.6won 5 · lost 13
GLM-5.1won 4 · lost 11
DeepSeek V4.1 Flashwon 4 · lost 11
GLM-5.3won 4 · lost 12
Gemini 3.5 Flashwon 4 · lost 13
Gemini 3.6 Flashwon 4 · lost 13
DeepSeek V4 Prowon 4 · lost 14
Claude Opus 4.6won 4 · lost 14
Muse Spark 1.2won 3 · lost 12
Gemini 3.7 Flashwon 3 · lost 13
Claude Sonnet 5won 3 · lost 14
Grok 4.5won 3 · lost 14
GPT-5.6 Terrawon 3 · lost 14
Muse Spark 1.1won 3 · lost 14
Gemini 3.8 Flashwon 3 · lost 14
GPT-5.4won 3 · lost 15
GPT-5.6 Solwon 3 · lost 15
Qwen3.8 Maxwon 2 · lost 15
Claude Opus 5won 2 · lost 15
Gemini 3 Prowon 2 · lost 16
Claude Opus 4.7won 2 · lost 16
Mimo V2.6 Prowon 1 · lost 11
Kimi K3won 1 · lost 15
Claude Opus 4.8won 1 · lost 16
Muse Spark 1.3won 0 · lost 12
Muse Sparkwon 0 · lost 13
Claude Opus 5.5won 0 · lost 14
GPT-6 Astrawon 0 · lost 15
Claude Fable 5.1won 0 · lost 16
Claude Fable 5won 0 · lost 16
GPT-5.5won 0 · lost 18

§ 3 · Sources

Where the numbers come from

6 publications, 15 figures. Every one links to the page it was read from.

LMArena Text ↗1 measureread 2026-09-26
LMArena Text 1457
ARC-AGI-2 ↗1 measureread 2026-09-26
ARC-AGI-2 4.9%
Kagi LLM Benchmark ↗1 measureread 2026-09-26
Kagi LLM Benchmark 75%
SimpleBench ↗1 measureread 2026-09-26
SimpleBench 53.2%
Vals.ai ↗10 measuresread 2026-09-26
Vals · CaseLaw 52.52%Vals · LegalBench 84.06%Vals · CorpFin 62.9%Vals · TaxEval 70.03%Vals · MedQA 94.27%Vals · SWE-bench Verified 71.4% (Mini-SWE-agent)Vals · Vibe Code Bench 23.36% (OpenHands)Vals · GPQA Diamond 83.33%Vals · MMLU Pro 86.03%Vals · AIME 91.67%
Vectara · Factual consistency 89.9%

Badge

PublicAI Index badge for GLM-5[![PublicAI Index](https://publicai.io/model-index/badge?model=glm-5)](https://publicai.io/model-index/m/glm-5)