Model comparison

Claude Haiku 5.5 vs Gemini 1.5 Flash 8B

Claude Haiku 5.5 is the stronger model overall, scoring 49.5 to 29.9 on the Noometry Index.

Last verified . 2 shared benchmarks.

Claude Haiku 5.5 Anthropic

49.5

Rank #52 Confirmed

Gemini 1.5 Flash 8B Google

29.9

Rank #301 Confirmed

Summary

  • They share 2 benchmarks with published results for both. Claude Haiku 5.5 scores higher in 5 categories and Gemini 1.5 Flash 8B in 0 categories; 5 gaps are clear of the uncertainty.
  • The widest gap is in math, where Claude Haiku 5.5 leads 73.6 to 14.2.
  • The biggest single-benchmark swing is OTIS Mock AIME 2024-2025: 98.9% for Claude Haiku 5.5 and 4.6% for Gemini 1.5 Flash 8B.

Side by side

Claude Haiku 5.5 and Gemini 1.5 Flash 8B specifications
Claude Haiku 5.5Gemini 1.5 Flash 8B
ProviderAnthropicGoogle
Noometry Index49.529.9
Released2026-10-072024-10-03
WeightsProprietaryProprietary
Context window1M—
Max output128K—
Input $ / M tokens$0.10—
Output $ / M tokens$0.50—
Results tracked921

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude Haiku 5.5 leads

Claude Haiku 5.5: 49.2 (#50), Gemini 1.5 Flash 8B: 35.5 (#225)

Coding benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
LMArena WebDev1587—
LMArena Coding—1218

Reasoning Claude Haiku 5.5 leads

Claude Haiku 5.5: 35.2 (#69), Gemini 1.5 Flash 8B: 20.0 (#244)

Reasoning benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
NYT Connections (extended)65.7%—
LMArena Hard Prompts—1209
Mystery Game Puzzles30%—
DTBench—50%

Math Claude Haiku 5.5 leads

Claude Haiku 5.5: 73.6 (#18), Gemini 1.5 Flash 8B: 14.2 (#302)

Math benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
OTIS Mock AIME 2024-202598.9%4.6%
FrontierMath (Tiers 1-3)75.1%—
FrontierMath Tier 446.3%—
LMArena Math—1207

Knowledge Claude Haiku 5.5 leads

Claude Haiku 5.5: 50.8 (#70), Gemini 1.5 Flash 8B: 16.0 (#289)

Knowledge benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
GPQA Diamond89.6%33%
SimpleQA Verified23.8%—
LMArena Expert—1185

Multimodal Claude Haiku 5.5 leads

Claude Haiku 5.5: 43.7 (#21), Gemini 1.5 Flash 8B: 28.2 (#115)

Multimodal benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
LMArena Vision—1044
Furniture Assembly47.5%—

Multilingual Not comparable

Claude Haiku 5.5: —, Gemini 1.5 Flash 8B: 38.5 (#229)

Multilingual benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
LMArena Non-English—1215
LMArena Chinese—1231
LMArena French—1234
LMArena German—1206
LMArena Japanese—1150
LMArena Korean—1140
LMArena Russian—1236
LMArena Spanish—1212

Instruction Following Not comparable

Claude Haiku 5.5: —, Gemini 1.5 Flash 8B: 62.8 (#236)

Instruction Following benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
LMArena Instruction Following—1199

Long Context Not comparable

Claude Haiku 5.5: —, Gemini 1.5 Flash 8B: 37.0 (#225)

Long Context benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
LMArena Longer Query—1219

Writing & Preference Not comparable

Claude Haiku 5.5: —, Gemini 1.5 Flash 8B: 42.8 (#232)

Writing & Preference benchmarks
BenchmarkClaude Haiku 5.5Gemini 1.5 Flash 8B
LMArena Text—1226
LMArena Creative Writing—1218
LMArena Multi-Turn—1185

Frequently asked questions

Is Claude Haiku 5.5 better than Gemini 1.5 Flash 8B?

Claude Haiku 5.5 is the stronger model overall, scoring 49.5 to 29.9 on the Noometry Index.

Is Claude Haiku 5.5 or Gemini 1.5 Flash 8B better for coding?

Claude Haiku 5.5 scores higher on coding benchmarks: 49.2 versus 35.5 in the Noometry coding category.

How many benchmarks do Claude Haiku 5.5 and Gemini 1.5 Flash 8B share?

2 benchmarks have published results for both models. Claude Haiku 5.5 has 9 scored results on Noometry and Gemini 1.5 Flash 8B has 21.

Related comparisons

Go deeper