Model comparison

Claude 3.5 Haiku vs Claude 3 Haiku

Claude 3.5 Haiku is the stronger model overall, scoring 29.2 to 25.9 on the Noometry Index.

Last verified . 30 shared benchmarks.

Claude 3.5 Haiku Anthropic

29.2

Rank #315 Confirmed

Claude 3 Haiku Anthropic

25.9

Rank #340 Confirmed

Summary

  • They share 30 benchmarks with published results for both. Claude 3.5 Haiku scores higher in 9 categories and Claude 3 Haiku in 0 categories; 9 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Claude 3.5 Haiku leads 42.7 to 29.7.
  • The biggest single-benchmark swing is MATH Level 5: 46.4% for Claude 3.5 Haiku and 14.9% for Claude 3 Haiku.

Side by side

Claude 3.5 Haiku and Claude 3 Haiku specifications
Claude 3.5 HaikuClaude 3 Haiku
ProviderAnthropicAnthropic
Noometry Index29.225.9
Released2024-10-222024-03-07
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked4937

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude 3.5 Haiku leads

Claude 3.5 Haiku: 32.9 (#265), Claude 3 Haiku: 26.4 (#325)

Coding benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
WeirdML30.7%9.8%
BigCodeBench Instruct46.1%39.4%
LMArena Coding12861199
BigCodeBench Complete59%50.1%
CadEval32%12%
Aider Polyglot28%—
SciCode27.4%—
LiveBench Coding51.4%—
HumanEval+—68.9%
MBPP+—68.8%

Agentic & Tool Use Not comparable

Claude 3.5 Haiku: 28.0 (#95), Claude 3 Haiku: —

Agentic & Tool Use benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
BALROG19.3%—

Reasoning Claude 3.5 Haiku leads

Claude 3.5 Haiku: 17.7 (#290), Claude 3 Haiku: 16.3 (#307)

Reasoning benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
LMArena Hard Prompts12511174
DTBench56.7%50.1%
Epoch Capabilities Index127.15118.35
Kagi LLM Benchmark—34.2%
CritPt0%—
LiveBench Reasoning28.1%—
LiveBench Data Analysis48.5%—
LMCA—8.8%
ForecastBench—53.2
LiveBench43.5%—
WinoGrande—74.2%

Math Claude 3.5 Haiku leads

Claude 3.5 Haiku: 14.7 (#300), Claude 3 Haiku: 9.8 (#319)

Math benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
OTIS Mock AIME 2024-20254.3%1.8%
LMArena Math12441188
MATH Level 546.4%14.9%
Omni-MATH22.4%—
LiveBench Math35.5%—
FrontierMath (Feb 2025 set)0.3%—

Knowledge Claude 3.5 Haiku leads

Claude 3.5 Haiku: 18.7 (#281), Claude 3 Haiku: 17.3 (#285)

Knowledge benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
GPQA Diamond38.1%36.3%
Confabulations36.7%34.2%
LMArena Expert12081148
MMLU74.3%73.8%
MMLU-Pro60.5%—
GPQA (HELM)36.3%—

Multimodal Claude 3.5 Haiku leads

Claude 3.5 Haiku: 26.8 (#117), Claude 3 Haiku: 23.6 (#128)

Multimodal benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
LMArena Vision1092950
GeoBench34%—
ScienceQA—72%

Multilingual Claude 3.5 Haiku leads

Claude 3.5 Haiku: 40.0 (#218), Claude 3 Haiku: 36.0 (#243)

Multilingual benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
LMArena Non-English12381178
LMArena Chinese12291155
LMArena French12641195
LMArena German12371174
LMArena Japanese11751102
LMArena Korean11731109
LMArena Russian12531204
LMArena Spanish12611166

Instruction Following Claude 3.5 Haiku leads

Claude 3.5 Haiku: 62.9 (#234), Claude 3 Haiku: 61.3 (#247)

Instruction Following benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
LMArena Instruction Following12411173
LiveBench Instruction Following61.9%—
IFEval79.2%—

Long Context Claude 3.5 Haiku leads

Claude 3.5 Haiku: 38.3 (#200), Claude 3 Haiku: 36.1 (#237)

Long Context benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
LMArena Longer Query12611190

Writing & Preference Claude 3.5 Haiku leads

Claude 3.5 Haiku: 42.7 (#234), Claude 3 Haiku: 29.7 (#291)

Writing & Preference benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Haiku
LMArena Text12551195
LMArena Creative Writing12331157
EQ-Bench Creative Writing1146717
LMArena Multi-Turn12651190
Short-Story Creative Writing73.5%—
WildBench76%—
LiveBench Language35.4%—

Frequently asked questions

Is Claude 3.5 Haiku better than Claude 3 Haiku?

Claude 3.5 Haiku is the stronger model overall, scoring 29.2 to 25.9 on the Noometry Index.

Is Claude 3.5 Haiku or Claude 3 Haiku better for coding?

Claude 3.5 Haiku scores higher on coding benchmarks: 32.9 versus 26.4 in the Noometry coding category.

How many benchmarks do Claude 3.5 Haiku and Claude 3 Haiku share?

30 benchmarks have published results for both models. Claude 3.5 Haiku has 49 scored results on Noometry and Claude 3 Haiku has 37.

Related comparisons

Go deeper