Request a pilot
‹ PublicAI Index

The LLM benchmark aggregator.

Command R Plus

Cohere

Strongest in Factual grounding (#30 of 101), weakest in Safety (#274 of 337). Above par in 2 of 18 scopes. Among the models it meets almost everywhere, it finishes behind O3 and O1 and ahead of Jamba 1.6 Mini and Jamba 1.5 Mini.

§ 1 · Profile

What it is good at

Bars run from 50 — the average of the models each source lists — so right of the line is above par. The middle column is the gap to whoever leads that scope.

Knowledge30#137/138
Academic knowledge26#122/123
Professional41.8#150/168
Legal42.4#122/151
Medical32.9#136/140
Reasoning35.2#172/178
Science26.1#119/122
Reasoning35.3#135/140
Human preference45.1#240/342
Human preference45.1#240/342
Safety46#274/337
Factual grounding57.8#30/101
Safe-prompt compliance49.3#59/82
Jailbreak resistance57.2#80/272
Harm refusal46.6#213/300
Toxicity avoidance44.6#232/272
Fairness42.5#255/300
Secure code26#265/274

§ 2 · Head to head

What it beats, and what beats it

The same models turn up scope after scope. Counted once: where both were placed, who finished higher. Bars run right for Command R Plus, left for the other.

GPT-3.5 Turbowon 9 · lost 2
Jamba 1.5 Miniwon 7 · lost 4
Jamba 1.6 Miniwon 8 · lost 5
Jamba 1.6 Largewon 4 · lost 9
DeepSeek R1won 5 · lost 12
Grok 4.1 Fastwon 5 · lost 12
GPT OSS 120Bwon 5 · lost 13
Jamba 1.5 Largewon 3 · lost 8
Mimo V2.6 Flashwon 3 · lost 8
Gemini 1.5 Flashwon 4 · lost 11
GPT OSS 20Bwon 4 · lost 12
Command Awon 4 · lost 12
Grok 3won 4 · lost 13
Ling 3.0 Flashwon 3 · lost 10
Llama 4 Scout Instructwon 4 · lost 14
Gemma 4 31Bwon 3 · lost 11
Mistral Smallwon 3 · lost 12
GLM-4.6won 3 · lost 13
DeepSeek V4 Flashwon 3 · lost 13
Gemini 3.6 Flashwon 3 · lost 13
GPT-4.1 Nanowon 3 · lost 14
Gemini 1.5 Prowon 3 · lost 14
Grok 4won 3 · lost 14
Kimi K2.6won 3 · lost 14
Grok 4 Fastwon 2 · lost 10
DeepSeek V3won 3 · lost 15
Kimi K2won 3 · lost 15
Mistral Largewon 2 · lost 13
GLM-4.5won 2 · lost 13
Mimo V2.5 Prowon 2 · lost 13
GPT-4o Miniwon 2 · lost 14
MiniMax M3won 2 · lost 14
Grok 4.3won 2 · lost 14
GLM-5.3 Flashwon 2 · lost 14
Qwen3.7 Maxwon 2 · lost 14
GLM-5.2won 2 · lost 14
Gemini 3.5 Flashwon 2 · lost 14
DeepSeek V3.2won 2 · lost 15
Kimi K2.5won 2 · lost 15
DeepSeek V4 Prowon 2 · lost 15
GPT-5.5won 2 · lost 15
GPT-5.6 Solwon 2 · lost 15
GPT-4owon 2 · lost 16
GPT-5 Nanowon 2 · lost 16
Gemini 2.5 Flashwon 2 · lost 16
Claude Haiku 4.5won 2 · lost 16
Qwen3 235B A22B Instructwon 2 · lost 16
Gemini 2.5 Prowon 2 · lost 16
GPT-5.1won 2 · lost 16
Claude 3 Opuswon 1 · lost 10
Qwen3.5 Flashwon 1 · lost 10
Gemini 3.1 Flash Litewon 1 · lost 10
GPT-5.4 Miniwon 1 · lost 10
GPT-5.4 Nanowon 1 · lost 11
Mistral Large 3won 1 · lost 11
Claude Opus 4.1won 1 · lost 11
GLM-5won 1 · lost 11
Gemini 3 Flashwon 1 · lost 11
Claude Opus 4.5won 1 · lost 11
Gemini 3.1 Prowon 1 · lost 11
GPT-6 Lunawon 1 · lost 12
Kimi K2 Thinkingwon 1 · lost 13
Claude 3.5 Haikuwon 1 · lost 13
GPT-6 Solwon 1 · lost 13
Claude Sonnet 4.6won 1 · lost 14
Gemini 3 Prowon 1 · lost 14
Claude Opus 4.6won 1 · lost 14
Grok 4.6won 1 · lost 15
GPT-5.6 Lunawon 1 · lost 15
GLM-5.1won 1 · lost 15
Grok 4.5won 1 · lost 15
GPT-5.6 Terrawon 1 · lost 15
Qwen3.8 Maxwon 1 · lost 15
Claude Opus 5won 1 · lost 15
Gemini 3.8 Flashwon 1 · lost 15
GPT-4.1 Miniwon 1 · lost 16
GPT-5.2won 1 · lost 16
GPT-5.4won 1 · lost 16
Claude Opus 4.7won 1 · lost 16
GPT-5 Miniwon 1 · lost 17
O4 Miniwon 1 · lost 17
Claude Sonnet 4won 1 · lost 17
GPT-4.1won 1 · lost 17
Claude Opus 4won 1 · lost 17
GPT-5won 1 · lost 17
Claude Sonnet 4.5won 1 · lost 17
Mimo V2.6 Prowon 0 · lost 11
O1 Miniwon 0 · lost 13
Grok 4.7won 0 · lost 13
Claude Opus 5.5won 0 · lost 13
GPT-4 Turbowon 0 · lost 14
Gemini 2.5 Flash Litewon 0 · lost 14
MiniMax M2.7won 0 · lost 15
Claude 3.5 Sonnetwon 0 · lost 16
Inklingwon 0 · lost 16
Claude Sonnet 5won 0 · lost 16
Claude Opus 4.8won 0 · lost 16
Muse Spark 1.1won 0 · lost 16
Gemini 2.0 Flashwon 0 · lost 17
O3 Miniwon 0 · lost 17
Claude 3.7 Sonnetwon 0 · lost 17
O1won 0 · lost 17
O3won 0 · lost 17

§ 3 · Sources

Where the numbers come from

6 publications, 18 figures. Every one links to the page it was read from.

LMArena Text ↗1 measureread 2026-09-26
LMArena Text 1276
SimpleBench ↗1 measureread 2026-09-26
SimpleBench 17.4%
Vals.ai ↗4 measuresread 2026-09-26
Vals · LegalBench 68.29%Vals · MedQA 2.65%Vals · GPQA Diamond 31.06%Vals · MMLU Pro 44%
HELM Safety ↗5 measuresread 2026-09-26
HELM Safety · HarmBench 48.5%HELM Safety · SimpleSafetyTests 100%HELM Safety · Anthropic Red Team 98%HELM Safety · BBQ 89.9%HELM Safety · XSTest 93.8%
Enkrypt AI Safety Leaderboard ↗6 measuresread 2026-09-26
Enkrypt · Jailbreak risk 6.7%Enkrypt · Harmful content risk 60%Enkrypt · CBRN risk 9.2%Enkrypt · Toxicity risk 10.1%Enkrypt · Bias risk 98.7%Enkrypt · Insecure code risk 86.7%
Vectara · Factual consistency 93.1%

Badge

PublicAI Index badge for Command R Plus[![PublicAI Index](https://publicai.io/model-index/badge?model=command-r-plus)](https://publicai.io/model-index/m/command-r-plus)