Request a pilot
‹ PublicAI Index

The LLM benchmark aggregator.

Mixtral (8x7B)

Mistral

Strongest in Safe-prompt compliance (#62 of 82), weakest in Safety (#301 of 336). Above par in 0 of 7 scopes. Among the models it meets almost everywhere, it finishes behind GPT-5.1 and GPT-5.

§ 1 · Profile

What it is good at

Bars run from 50 — the average of the models each source lists — so right of the line is above par. The middle column is the gap to whoever leads that scope.

Professional39.4#156/168
Medical33.8#131/140
Legal35#145/151
Safety43.3#301/336
Safe-prompt compliance47.7#62/82
Fairness47.2#155/299
Harm refusal39#290/299

§ 2 · Head to head

What it beats, and what beats it

The same models turn up scope after scope. Counted once: where both were placed, who finished higher. Bars run right for Mixtral (8x7B), left for the other.

Jamba 1.6 Miniwon 3 · lost 3
Jamba 1.6 Largewon 3 · lost 3
Command Rwon 3 · lost 3
Llama 4 Scout Instructwon 3 · lost 4
Gemini 1.5 Flashwon 2 · lost 4
Jamba 1.5 Miniwon 2 · lost 4
Grok 4.1 Fastwon 2 · lost 4
GPT-4.1 Nanowon 2 · lost 5
Command R Pluswon 2 · lost 5
Mistral Smallwon 1 · lost 4
Gemma 2 9B Itwon 1 · lost 4
Gemma 4 31Bwon 1 · lost 4
Mimo V2.6 Flashwon 1 · lost 4
Mimo V2.6 Prowon 1 · lost 4
Jamba 1.5 Largewon 1 · lost 5
GPT-4o Miniwon 1 · lost 5
Ling 3.0 Flashwon 1 · lost 5
Command Awon 1 · lost 5
Grok 4.3won 1 · lost 5
Kimi K2.5won 1 · lost 5
GLM-4.6won 1 · lost 5
DeepSeek V4 Flashwon 1 · lost 5
GLM-5.2won 1 · lost 5
Gemini 3.6 Flashwon 1 · lost 5
GPT-5.4won 1 · lost 5
DeepSeek V4 Prowon 1 · lost 5
Gemini 1.5 Prowon 1 · lost 6
GPT OSS 20Bwon 1 · lost 6
GPT OSS 120Bwon 1 · lost 6
Grok 4won 1 · lost 6
Claude 3.5 Haikuwon 0 · lost 5
Gemini 2.0 Prowon 0 · lost 5
Gemma 2 27B Itwon 0 · lost 5
Mistral Largewon 0 · lost 5
MiniMax M2.7won 0 · lost 6
Mimo V2.5 Prowon 0 · lost 6
DeepSeek V3.2won 0 · lost 6
GLM-5.1won 0 · lost 6
Claude 3.5 Sonnetwon 0 · lost 6
GPT-6 Lunawon 0 · lost 6
Qwen3.7 Maxwon 0 · lost 6
Kimi K2.6won 0 · lost 6
O1 Miniwon 0 · lost 6
GLM-4.5won 0 · lost 6
GPT-6 Solwon 0 · lost 6
GPT-5.6 Lunawon 0 · lost 6
Inklingwon 0 · lost 6
Gemini 3.8 Flashwon 0 · lost 6
Kimi K2 Thinkingwon 0 · lost 6
Grok 4.5won 0 · lost 6
GPT-5.6 Terrawon 0 · lost 6
MiniMax M3won 0 · lost 6
Gemini 3.5 Flashwon 0 · lost 6
Claude Sonnet 4.6won 0 · lost 6
Claude Sonnet 5won 0 · lost 6
Qwen3.8 Maxwon 0 · lost 6
GPT-5.6 Solwon 0 · lost 6
GPT-5.5won 0 · lost 6
GLM-5.3 Flashwon 0 · lost 6
GPT-5.2won 0 · lost 6
Claude Opus 4.6won 0 · lost 6
Grok 4.7won 0 · lost 6
Grok 4.6won 0 · lost 6
Claude Opus 4.7won 0 · lost 6
Claude Opus 4.8won 0 · lost 6
Claude Opus 5.5won 0 · lost 6
Muse Spark 1.1won 0 · lost 6
Claude Opus 5won 0 · lost 6
GPT-5 Nanowon 0 · lost 7
Gemini 2.0 Flashwon 0 · lost 7
Claude Haiku 4.5won 0 · lost 7
O3 Miniwon 0 · lost 7
Gemini 2.5 Flash Litewon 0 · lost 7
DeepSeek R1won 0 · lost 7
Claude Sonnet 4won 0 · lost 7
Kimi K2won 0 · lost 7
DeepSeek V3won 0 · lost 7
GPT-4owon 0 · lost 7
O4 Miniwon 0 · lost 7
GPT-4 Turbowon 0 · lost 7
GPT-4.1 Miniwon 0 · lost 7
Gemini 2.5 Flashwon 0 · lost 7
Claude Opus 4won 0 · lost 7
Grok 3won 0 · lost 7
Grok 3 Miniwon 0 · lost 7
O1won 0 · lost 7
Claude 3.7 Sonnetwon 0 · lost 7
Gemini 3 Prowon 0 · lost 7
O3won 0 · lost 7
Claude Sonnet 4.5won 0 · lost 7
Gemini 2.5 Prowon 0 · lost 7
GPT-5 Miniwon 0 · lost 7
GPT-4.1won 0 · lost 7
GPT-5won 0 · lost 7
GPT-5.1won 0 · lost 7

§ 3 · Sources

Where the numbers come from

2 publications, 7 figures. Every one links to the page it was read from.

Vals.ai ↗2 measuresread 2026-09-27
Vals · LegalBench 55.84%Vals · MedQA 53.22%
HELM Safety ↗5 measuresread 2026-09-27
HELM Safety · HarmBench 45.1%HELM Safety · SimpleSafetyTests 90.5%HELM Safety · Anthropic Red Team 92.8%HELM Safety · BBQ 85.7%HELM Safety · XSTest 93.1%

Badge

PublicAI Index badge for Mixtral (8x7B)[![PublicAI Index](https://publicai.io/model-index/badge?model=mixtral-8x7b)](https://publicai.io/model-index/m/mixtral-8x7b)