Model comparison

Amazon Nova Lite vs Claude 3 Haiku

Amazon Nova Lite is the stronger model overall, scoring 31.9 to 25.9 on the Noometry Index.

Last verified . 19 shared benchmarks.

Amazon Nova Lite Amazon

31.9

Rank #265 Confirmed

Claude 3 Haiku Anthropic

25.9

Rank #340 Confirmed

Summary

  • They share 19 benchmarks with published results for both. Amazon Nova Lite scores higher in 8 categories and Claude 3 Haiku in 1 category; 9 gaps are clear of the uncertainty.
  • The widest gap is in math, where Amazon Nova Lite leads 27.8 to 9.8.

Side by side

Amazon Nova Lite and Claude 3 Haiku specifications
Amazon Nova LiteClaude 3 Haiku
ProviderAmazonAnthropic
Noometry Index31.925.9
Released2024-12-032024-03-07
WeightsProprietaryProprietary
Context window300K—
Max output10K—
Input $ / M tokens$0.06—
Output $ / M tokens$0.24—
Results tracked3437

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Lite leads

Amazon Nova Lite: 32.5 (#270), Claude 3 Haiku: 26.4 (#325)

Coding benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Coding12391199
WeirdML—9.8%
BigCodeBench Instruct—39.4%
LiveBench Coding27.5%—
BigCodeBench Complete—50.1%
CadEval—12%
ALE-Bench236.25—
HumanEval+—68.9%
MBPP+—68.8%

Reasoning Amazon Nova Lite leads

Amazon Nova Lite: 19.3 (#260), Claude 3 Haiku: 16.3 (#307)

Reasoning benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Hard Prompts12201174
Kagi LLM Benchmark—34.2%
LiveBench Reasoning36.7%—
DTBench—50.1%
LiveBench Data Analysis37.2%—
LMCA—8.8%
Epoch Capabilities Index—118.35
ForecastBench—53.2
LiveBench36.4%—
WinoGrande—74.2%

Math Amazon Nova Lite leads

Amazon Nova Lite: 27.8 (#247), Claude 3 Haiku: 9.8 (#319)

Math benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Math12271188
OTIS Mock AIME 2024-2025—1.8%
Omni-MATH23.3%—
LiveBench Math36.7%—
MATH Level 5—14.9%

Knowledge Amazon Nova Lite leads

Amazon Nova Lite: 26.3 (#259), Claude 3 Haiku: 17.3 (#285)

Knowledge benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Expert12011148
MMLU77%73.8%
GPQA Diamond—36.3%
Humanity's Last Exam3.6%—
MMLU-Pro60%—
Confabulations—34.2%
Vectara Hallucination Rate6.1%—
GPQA (HELM)39.7%—

Multimodal Amazon Nova Lite leads

Amazon Nova Lite: 25.5 (#123), Claude 3 Haiku: 23.6 (#128)

Multimodal benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Vision990950
ScienceQA—72%

Multilingual Amazon Nova Lite leads

Amazon Nova Lite: 38.0 (#232), Claude 3 Haiku: 36.0 (#243)

Multilingual benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Non-English12081178
LMArena Chinese12251155
LMArena French12371195
LMArena German12291174
LMArena Japanese11531102
LMArena Korean11531109
LMArena Russian12161204
LMArena Spanish12261166

Instruction Following Claude 3 Haiku leads

Amazon Nova Lite: 59.3 (#255), Claude 3 Haiku: 61.3 (#247)

Instruction Following benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Instruction Following12051173
LiveBench Instruction Following54.1%—
IFEval77.6%—

Long Context Amazon Nova Lite leads

Amazon Nova Lite: 37.4 (#217), Claude 3 Haiku: 36.1 (#237)

Long Context benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Longer Query12341190

Writing & Preference Amazon Nova Lite leads

Amazon Nova Lite: 42.1 (#237), Claude 3 Haiku: 29.7 (#291)

Writing & Preference benchmarks
BenchmarkAmazon Nova LiteClaude 3 Haiku
LMArena Text12291195
LMArena Creative Writing11971157
LMArena Multi-Turn11991190
EQ-Bench Creative Writing—717
WildBench75%—
LiveBench Language25.9%—

Frequently asked questions

Is Amazon Nova Lite better than Claude 3 Haiku?

Amazon Nova Lite is the stronger model overall, scoring 31.9 to 25.9 on the Noometry Index.

Is Amazon Nova Lite or Claude 3 Haiku better for coding?

Amazon Nova Lite scores higher on coding benchmarks: 32.5 versus 26.4 in the Noometry coding category.

How many benchmarks do Amazon Nova Lite and Claude 3 Haiku share?

19 benchmarks have published results for both models. Amazon Nova Lite has 34 scored results on Noometry and Claude 3 Haiku has 37.

Related comparisons

Go deeper