Model comparison

Amazon Nova Experimental Chat 10 20 vs Claude Haiku 4.5

Amazon Nova Experimental Chat 10 20 is the stronger model overall, scoring 42.1 to 39.5 on the Noometry Index.

Last verified . 17 shared benchmarks.

Claude Haiku 4.5 Anthropic

39.5

Rank #165 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Amazon Nova Experimental Chat 10 20 scores higher in 3 categories and Claude Haiku 4.5 in 5 categories; 5 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Amazon Nova Experimental Chat 10 20 leads 28.4 to 15.1.

Side by side

Amazon Nova Experimental Chat 10 20 and Claude Haiku 4.5 specifications
Amazon Nova Experimental Chat 10 20Claude Haiku 4.5
ProviderAmazonAnthropic
Noometry Index42.139.5
Released—2025-10-15
WeightsProprietaryProprietary
Context window—200K
Max output—64K
Input $ / M tokens—$1
Output $ / M tokens—$5
Results tracked1753

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude Haiku 4.5 leads

Amazon Nova Experimental Chat 10 20: 41.6 (#123), Claude Haiku 4.5: 44.0 (#78)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
LMArena Coding14121453
SWE-bench Verified (bash only)—66.6%
LMArena WebDev—1330
SWE-bench Multilingual—64.7%
SciCode—43.3%
WeirdML—45.4%
ALE-Bench—653.48

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 10 20: —, Claude Haiku 4.5: 33.6 (#52)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
Terminal-Bench—35.5%
Berkeley Function Calling Leaderboard—68.7%
DeepResearch Bench—45.5%
BALROG—31.2%
ExploitBench—13.7%
Vending-Bench 2—458.89

Reasoning Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 28.4 (#106), Claude Haiku 4.5: 15.1 (#320)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
LMArena Hard Prompts13961420
ARC-AGI-2—4%
NYT Connections (extended)—14.3%
ARC-AGI-1—47.7%
CritPt—0%
Chess Puzzles—8%
DTBench—73.6%
LMCA—30.9%
Epoch Capabilities Index—142.41
ForecastBench—61.4

Math Claude Haiku 4.5 leads

Amazon Nova Experimental Chat 10 20: 39.0 (#119), Claude Haiku 4.5: 44.9 (#78)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
LMArena Math14251396
OTIS Mock AIME 2024-2025—66.7%
Omni-MATH—56.1%
MATH Level 5—96.4%
FrontierMath (Feb 2025 set)—5.9%
FrontierMath Tier 4 (v1)—2.1%

Knowledge Too close to call

Amazon Nova Experimental Chat 10 20: 38.5 (#144), Claude Haiku 4.5: 37.7 (#153)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
LMArena Expert13861442
GPQA Diamond—71.2%
SimpleQA Verified—13.2%
MMLU-Pro—77.7%
Vectara Hallucination Rate—9.8%
GPQA (HELM)—60.5%

Multimodal Not comparable

Amazon Nova Experimental Chat 10 20: —, Claude Haiku 4.5: 26.8 (#118)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
Blueprint-Bench 2—0%
LMArena Document—1420

Multilingual Too close to call

Amazon Nova Experimental Chat 10 20: 49.5 (#131), Claude Haiku 4.5: 49.9 (#129)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
LMArena Non-English13721377
LMArena Chinese14041417
LMArena French14251408
LMArena German13911375
LMArena Japanese13601339
LMArena Korean13241347
LMArena Russian13711381
LMArena Spanish13821420

Instruction Following Too close to call

Amazon Nova Experimental Chat 10 20: 72.1 (#141), Claude Haiku 4.5: 71.4 (#149)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
LMArena Instruction Following13651414
IFEval—80.1%

Long Context Claude Haiku 4.5 leads

Amazon Nova Experimental Chat 10 20: 41.7 (#133), Claude Haiku 4.5: 43.6 (#92)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
LMArena Longer Query13701427

Writing & Preference Claude Haiku 4.5 leads

Amazon Nova Experimental Chat 10 20: 56.6 (#136), Claude Haiku 4.5: 57.9 (#123)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Haiku 4.5
LMArena Text13941396
LMArena Creative Writing13181372
LMArena Multi-Turn13641409
WildBench—83.9%
EQ-Bench 4—1064

Frequently asked questions

Is Amazon Nova Experimental Chat 10 20 better than Claude Haiku 4.5?

Amazon Nova Experimental Chat 10 20 is the stronger model overall, scoring 42.1 to 39.5 on the Noometry Index.

Is Amazon Nova Experimental Chat 10 20 or Claude Haiku 4.5 better for coding?

Claude Haiku 4.5 scores higher on coding benchmarks: 44.0 versus 41.6 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 10 20 and Claude Haiku 4.5 share?

17 benchmarks have published results for both models. Amazon Nova Experimental Chat 10 20 has 17 scored results on Noometry and Claude Haiku 4.5 has 53.

Related comparisons

Go deeper