Request a pilot
‹ PublicAI Index

The LLM benchmark aggregator.

Gemini 1.5 Flash

Google

Strongest in Safe-prompt compliance (#68 of 82), weakest in Toxicity avoidance (#229 of 272). Above par in 4 of 17 scopes. Among the models it meets almost everywhere, it finishes behind GPT-5.1 and GPT-5 and ahead of Mistral Small and Jamba 1.5 Mini.

§ 1 · Profile

What it is good at

Bars run from 50 — the average of the models each source lists — so right of the line is above par. The middle column is the gap to whoever leads that scope.

Knowledge33.7#131/138
Academic knowledge30.5#115/123
Safety50.8#161/337
Safe-prompt compliance45.5#68/82
Secure code58.8#77/274
Fairness49.2#126/300
Harm refusal51.6#132/300
Jailbreak resistance52.9#144/272
Toxicity avoidance45.6#229/272
Reasoning36.6#166/178
Science29#113/122
Mathematics37#119/140
Professional35.9#168/168
Legal38.6#135/151
Finance29.2#151/151
Human preference48.2#212/342
Human preference48.2#212/342

§ 2 · Head to head

What it beats, and what beats it

The same models turn up scope after scope. Counted once: where both were placed, who finished higher. Bars run right for Gemini 1.5 Flash, left for the other.

Command R Pluswon 11 · lost 4
Jamba 1.5 Largewon 8 · lost 3
Jamba 1.6 Miniwon 10 · lost 4
Jamba 1.6 Largewon 10 · lost 4
Jamba 1.5 Miniwon 7 · lost 4
Mistral Smallwon 9 · lost 6
Mistral Largewon 7 · lost 8
Ling 3.0 Flashwon 5 · lost 8
Mimo V2.6 Flashwon 5 · lost 8
GPT-4o Miniwon 6 · lost 10
Claude 3.5 Haikuwon 6 · lost 10
Command Awon 6 · lost 10
Grok 3won 6 · lost 10
Grok 4.1 Fastwon 6 · lost 10
MiniMax M3won 6 · lost 10
GLM-4.6won 5 · lost 11
DeepSeek V4 Flashwon 5 · lost 11
Grok 4.3won 5 · lost 11
GLM-5.3 Flashwon 5 · lost 11
Gemini 3.6 Flashwon 5 · lost 11
GPT OSS 20Bwon 5 · lost 12
DeepSeek V3won 5 · lost 12
Grok 4won 5 · lost 12
Gemma 4 31Bwon 4 · lost 10
GLM-4.5won 4 · lost 12
DeepSeek R1won 4 · lost 12
DeepSeek V3.2won 4 · lost 12
Kimi K2.5won 4 · lost 12
DeepSeek V4 Prowon 4 · lost 12
Mimo V2.5 Prowon 4 · lost 12
GLM-5.2won 4 · lost 12
Gemini 3.5 Flashwon 4 · lost 12
Llama 4 Scout Instructwon 4 · lost 13
GPT-4.1 Nanowon 4 · lost 13
Gemini 2.5 Prowon 4 · lost 13
GPT-6 Solwon 3 · lost 10
Mimo V2.6 Prowon 3 · lost 10
Kimi K2 Thinkingwon 3 · lost 11
Kimi K2.6won 3 · lost 13
Qwen3.7 Maxwon 3 · lost 13
Gemini 1.5 Prowon 3 · lost 14
Gemini 2.5 Flashwon 3 · lost 14
GPT-6 Lunawon 2 · lost 11
Claude Sonnet 4.6won 2 · lost 12
Claude 3.5 Sonnetwon 2 · lost 14
Gemini 3.8 Flashwon 2 · lost 14
GPT-4owon 2 · lost 15
GPT OSS 120Bwon 2 · lost 15
GPT-4.1 Miniwon 2 · lost 15
Kimi K2won 2 · lost 15
Qwen3.5 Flashwon 1 · lost 10
Grok 4 Fastwon 1 · lost 10
Mistral Large 3won 1 · lost 10
Claude Opus 4.1won 1 · lost 10
GLM-5won 1 · lost 10
Gemini 3 Flashwon 1 · lost 10
Claude Opus 4.5won 1 · lost 10
Gemini 3.1 Prowon 1 · lost 10
Gemini 2.5 Flash Litewon 1 · lost 13
Gemini 3 Prowon 1 · lost 13
Claude Opus 4.6won 1 · lost 13
GLM-5.1won 1 · lost 15
Grok 4.5won 1 · lost 15
GPT-5.4won 1 · lost 15
Qwen3.8 Maxwon 1 · lost 15
Claude Opus 4.8won 1 · lost 15
Claude Opus 5won 1 · lost 15
Muse Spark 1.1won 1 · lost 15
Claude Opus 4.7won 1 · lost 15
GPT-5 Nanowon 1 · lost 16
Gemini 2.0 Flashwon 1 · lost 16
O3 Miniwon 1 · lost 16
Claude 3.7 Sonnetwon 1 · lost 16
Claude Haiku 4.5won 1 · lost 16
Qwen3 235B A22B Instructwon 1 · lost 16
Claude Opus 4won 1 · lost 16
Claude Sonnet 4.5won 1 · lost 16
O1 Miniwon 0 · lost 11
GPT-5.4 Nanowon 0 · lost 11
Gemini 3.1 Flash Litewon 0 · lost 11
GPT-5.4 Miniwon 0 · lost 11
GPT-4 Turbowon 0 · lost 12
Grok 4.7won 0 · lost 13
Claude Opus 5.5won 0 · lost 13
MiniMax M2.7won 0 · lost 16
GPT-5.2won 0 · lost 16
Inklingwon 0 · lost 16
Grok 4.6won 0 · lost 16
GPT-5.6 Lunawon 0 · lost 16
Claude Sonnet 5won 0 · lost 16
GPT-5.6 Terrawon 0 · lost 16
GPT-5.5won 0 · lost 16
GPT-5.6 Solwon 0 · lost 16
GPT-5 Miniwon 0 · lost 17
O4 Miniwon 0 · lost 17
Claude Sonnet 4won 0 · lost 17
O1won 0 · lost 17
GPT-4.1won 0 · lost 17
O3won 0 · lost 17
GPT-5won 0 · lost 17
GPT-5.1won 0 · lost 17

§ 3 · Sources

Where the numbers come from

4 publications, 19 figures. Every one links to the page it was read from.

LMArena Text ↗1 measureread 2026-09-26
LMArena Text 1309
Vals.ai ↗7 measuresread 2026-09-26
Vals · LegalBench 63.24%Vals · CorpFin 38.19%Vals · TaxEval 48.2%Vals · MortgageTax 42.77%Vals · GPQA Diamond 45.96%Vals · MMLU Pro 65.61%Vals · AIME 17.29%
HELM Safety ↗5 measuresread 2026-09-26
HELM Safety · HarmBench 80%HELM Safety · SimpleSafetyTests 97%HELM Safety · Anthropic Red Team 99.9%HELM Safety · BBQ 94.7%HELM Safety · XSTest 92.1%
Enkrypt AI Safety Leaderboard ↗6 measuresread 2026-09-26
Enkrypt · Jailbreak risk 10.3%Enkrypt · Harmful content risk 44.4%Enkrypt · CBRN risk 13.3%Enkrypt · Toxicity risk 9.4%Enkrypt · Bias risk 87.9%Enkrypt · Insecure code risk 15.6%

Badge

PublicAI Index badge for Gemini 1.5 Flash[![PublicAI Index](https://publicai.io/model-index/badge?model=gemini-1-5-flash)](https://publicai.io/model-index/m/gemini-1-5-flash)