Model comparison

Claude Haiku 5.5 vs Gemini 3.1 Flash Lite

Claude Haiku 5.5 is the stronger model overall, scoring 49.5 to 40.8 on the Noometry Index.

Last verified . 5 shared benchmarks.

Claude Haiku 5.5 Anthropic

49.5

Rank #52 Confirmed

Gemini 3.1 Flash Lite Google

40.8

Rank #144 Confirmed

Summary

  • They share 5 benchmarks with published results for both. Claude Haiku 5.5 scores higher in 5 categories and Gemini 3.1 Flash Lite in 0 categories; 5 gaps are clear of the uncertainty.
  • The widest gap is in math, where Claude Haiku 5.5 leads 73.6 to 40.7.
  • The biggest single-benchmark swing is NYT Connections (extended): 65.7% for Claude Haiku 5.5 and 8.2% for Gemini 3.1 Flash Lite.
  • Claude Haiku 5.5 is cheaper at $0.10 / $0.50 per million input/output tokens, against $0.25 / $1.50 for Gemini 3.1 Flash Lite.
  • Gemini 3.1 Flash Lite accepts more context: 1.05M tokens versus 1M.

Side by side

Claude Haiku 5.5 and Gemini 3.1 Flash Lite specifications
Claude Haiku 5.5Gemini 3.1 Flash Lite
ProviderAnthropicGoogle
Noometry Index49.540.8
Released2026-10-072026-03-03
WeightsProprietaryProprietary
Context window1M1.05M
Max output128K66K
Input $ / M tokens$0.10$0.25
Output $ / M tokens$0.50$1.50
Results tracked938

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude Haiku 5.5 leads

Claude Haiku 5.5: 49.2 (#50), Gemini 3.1 Flash Lite: 37.8 (#188)

Coding benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
LMArena WebDev15871256
SciCode—41.9%
WeirdML—52.2%
LMArena Coding—1400
ALE-Bench—797.73

Agentic & Tool Use Not comparable

Claude Haiku 5.5: —, Gemini 3.1 Flash Lite: 30.2 (#79)

Agentic & Tool Use benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
DeepResearch Bench—37.3%

Reasoning Claude Haiku 5.5 leads

Claude Haiku 5.5: 35.2 (#69), Gemini 3.1 Flash Lite: 22.9 (#186)

Reasoning benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
NYT Connections (extended)65.7%8.2%
Kagi LLM Benchmark—67.2%
CritPt—1.1%
Chess Puzzles—25%
EnigmaEval—3%
Thematic Generalization—63.3%
LMArena Hard Prompts—1407
Mystery Game Puzzles30%—
DTBench—76.8%
LMCA—35%
Epoch Capabilities Index—144.47
ForecastBench—54.4

Math Claude Haiku 5.5 leads

Claude Haiku 5.5: 73.6 (#18), Gemini 3.1 Flash Lite: 40.7 (#90)

Math benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
FrontierMath (Tiers 1-3)75.1%27.7%
OTIS Mock AIME 2024-202598.9%80%
FrontierMath Tier 446.3%—
LMArena Math—1428

Knowledge Claude Haiku 5.5 leads

Claude Haiku 5.5: 50.8 (#70), Gemini 3.1 Flash Lite: 41.9 (#104)

Knowledge benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
GPQA Diamond89.6%81.8%
Humanity's Last Exam—8.6%
SimpleQA Verified23.8%—
Vectara Hallucination Rate—8.2%
LMArena Expert—1398

Multimodal Claude Haiku 5.5 leads

Claude Haiku 5.5: 43.7 (#21), Gemini 3.1 Flash Lite: 39.4 (#60)

Multimodal benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
LMArena Vision—1240
Furniture Assembly47.5%—

Multilingual Not comparable

Claude Haiku 5.5: —, Gemini 3.1 Flash Lite: 52.3 (#86)

Multilingual benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
LMArena Non-English—1411
LMArena Chinese—1461
LMArena French—1424
LMArena German—1429
LMArena Japanese—1413
LMArena Korean—1392
LMArena Russian—1420
LMArena Spanish—1421

Instruction Following Not comparable

Claude Haiku 5.5: —, Gemini 3.1 Flash Lite: 72.7 (#131)

Instruction Following benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
LMArena Instruction Following—1377

Long Context Not comparable

Claude Haiku 5.5: —, Gemini 3.1 Flash Lite: 42.5 (#122)

Long Context benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
LMArena Longer Query—1394

Writing & Preference Not comparable

Claude Haiku 5.5: —, Gemini 3.1 Flash Lite: 60.9 (#94)

Writing & Preference benchmarks
BenchmarkClaude Haiku 5.5Gemini 3.1 Flash Lite
LMArena Text—1416
LMArena Creative Writing—1401
LMArena Multi-Turn—1417

Frequently asked questions

Is Claude Haiku 5.5 better than Gemini 3.1 Flash Lite?

Claude Haiku 5.5 is the stronger model overall, scoring 49.5 to 40.8 on the Noometry Index.

Which is cheaper, Claude Haiku 5.5 or Gemini 3.1 Flash Lite?

Claude Haiku 5.5 is cheaper. It lists at $0.10 per million input tokens and $0.50 per million output tokens; Gemini 3.1 Flash Lite lists at $0.25 and $1.50.

Is Claude Haiku 5.5 or Gemini 3.1 Flash Lite better for coding?

Claude Haiku 5.5 scores higher on coding benchmarks: 49.2 versus 37.8 in the Noometry coding category.

Which has the bigger context window?

Gemini 3.1 Flash Lite does, with 1.05M tokens against 1M.

How many benchmarks do Claude Haiku 5.5 and Gemini 3.1 Flash Lite share?

5 benchmarks have published results for both models. Claude Haiku 5.5 has 9 scored results on Noometry and Gemini 3.1 Flash Lite has 38.

Related comparisons

Go deeper