Model comparison

Claude 3.5 Haiku vs Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite is the stronger model overall, scoring 40.8 to 29.2 on the Noometry Index.

Last verified . 25 shared benchmarks.

Claude 3.5 Haiku Anthropic

29.2

Rank #315 Confirmed

Gemini 3.1 Flash Lite Google

40.8

Rank #144 Confirmed

Summary

  • They share 25 benchmarks with published results for both. Claude 3.5 Haiku scores higher in 0 categories and Gemini 3.1 Flash Lite in 10 categories; 10 gaps are clear of the uncertainty.
  • The widest gap is in math, where Gemini 3.1 Flash Lite leads 40.7 to 14.7.
  • The biggest single-benchmark swing is OTIS Mock AIME 2024-2025: 4.3% for Claude 3.5 Haiku and 80% for Gemini 3.1 Flash Lite.

Side by side

Claude 3.5 Haiku and Gemini 3.1 Flash Lite specifications
Claude 3.5 HaikuGemini 3.1 Flash Lite
ProviderAnthropicGoogle
Noometry Index29.240.8
Released2024-10-222026-03-03
WeightsProprietaryProprietary
Context window—1.05M
Max output—66K
Input $ / M tokens—$0.25
Output $ / M tokens—$1.50
Results tracked4938

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 32.9 (#265), Gemini 3.1 Flash Lite: 37.8 (#188)

Coding benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
SciCode27.4%41.9%
WeirdML30.7%52.2%
LMArena Coding12861400
Aider Polyglot28%—
LMArena WebDev—1256
BigCodeBench Instruct46.1%—
LiveBench Coding51.4%—
BigCodeBench Complete59%—
CadEval32%—
ALE-Bench—797.73

Agentic & Tool Use Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 28.0 (#95), Gemini 3.1 Flash Lite: 30.2 (#79)

Agentic & Tool Use benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
DeepResearch Bench—37.3%
BALROG19.3%—

Reasoning Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 17.7 (#290), Gemini 3.1 Flash Lite: 22.9 (#186)

Reasoning benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
CritPt0%1.1%
LMArena Hard Prompts12511407
DTBench56.7%76.8%
Epoch Capabilities Index127.15144.47
Kagi LLM Benchmark—67.2%
NYT Connections (extended)—8.2%
Chess Puzzles—25%
EnigmaEval—3%
Thematic Generalization—63.3%
LiveBench Reasoning28.1%—
LiveBench Data Analysis48.5%—
LMCA—35%
ForecastBench—54.4
LiveBench43.5%—

Math Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 14.7 (#300), Gemini 3.1 Flash Lite: 40.7 (#90)

Math benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
OTIS Mock AIME 2024-20254.3%80%
LMArena Math12441428
FrontierMath (Tiers 1-3)—27.7%
Omni-MATH22.4%—
LiveBench Math35.5%—
MATH Level 546.4%—
FrontierMath (Feb 2025 set)0.3%—

Knowledge Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 18.7 (#281), Gemini 3.1 Flash Lite: 41.9 (#104)

Knowledge benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
GPQA Diamond38.1%81.8%
LMArena Expert12081398
Humanity's Last Exam—8.6%
MMLU-Pro60.5%—
Confabulations36.7%—
Vectara Hallucination Rate—8.2%
GPQA (HELM)36.3%—
MMLU74.3%—

Multimodal Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 26.8 (#117), Gemini 3.1 Flash Lite: 39.4 (#60)

Multimodal benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
LMArena Vision10921240
GeoBench34%—

Multilingual Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 40.0 (#218), Gemini 3.1 Flash Lite: 52.3 (#86)

Multilingual benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
LMArena Non-English12381411
LMArena Chinese12291461
LMArena French12641424
LMArena German12371429
LMArena Japanese11751413
LMArena Korean11731392
LMArena Russian12531420
LMArena Spanish12611421

Instruction Following Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 62.9 (#234), Gemini 3.1 Flash Lite: 72.7 (#131)

Instruction Following benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
LMArena Instruction Following12411377
LiveBench Instruction Following61.9%—
IFEval79.2%—

Long Context Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 38.3 (#200), Gemini 3.1 Flash Lite: 42.5 (#122)

Long Context benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
LMArena Longer Query12611394

Writing & Preference Gemini 3.1 Flash Lite leads

Claude 3.5 Haiku: 42.7 (#234), Gemini 3.1 Flash Lite: 60.9 (#94)

Writing & Preference benchmarks
BenchmarkClaude 3.5 HaikuGemini 3.1 Flash Lite
LMArena Text12551416
LMArena Creative Writing12331401
LMArena Multi-Turn12651417
Short-Story Creative Writing73.5%—
EQ-Bench Creative Writing1146—
WildBench76%—
LiveBench Language35.4%—

Frequently asked questions

Is Claude 3.5 Haiku better than Gemini 3.1 Flash Lite?

Gemini 3.1 Flash Lite is the stronger model overall, scoring 40.8 to 29.2 on the Noometry Index.

Is Claude 3.5 Haiku or Gemini 3.1 Flash Lite better for coding?

Gemini 3.1 Flash Lite scores higher on coding benchmarks: 37.8 versus 32.9 in the Noometry coding category.

How many benchmarks do Claude 3.5 Haiku and Gemini 3.1 Flash Lite share?

25 benchmarks have published results for both models. Claude 3.5 Haiku has 49 scored results on Noometry and Gemini 3.1 Flash Lite has 38.

Related comparisons

Go deeper