Model comparison

Amazon Nova Experimental Chat 11 10 vs Amazon Nova Pro

Amazon Nova Experimental Chat 11 10 is the stronger model overall, scoring 43.0 to 31.0 on the Noometry Index.

Last verified . 17 shared benchmarks.

Amazon Nova Pro Amazon

31.0

Rank #281 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Amazon Nova Experimental Chat 11 10 scores higher in 8 categories and Amazon Nova Pro in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Amazon Nova Experimental Chat 11 10 leads 58.8 to 43.9.

Side by side

Amazon Nova Experimental Chat 11 10 and Amazon Nova Pro specifications
Amazon Nova Experimental Chat 11 10Amazon Nova Pro
ProviderAmazonAmazon
Noometry Index43.031.0
Released—2024-12-03
WeightsProprietaryProprietary
Context window—300K
Max output—10K
Input $ / M tokens—$0.80
Output $ / M tokens—$3.20
Results tracked1738

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 42.3 (#107), Amazon Nova Pro: 35.1 (#229)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Coding14331270
LiveBench Coding—38.1%

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 11 10: —, Amazon Nova Pro: 16.7 (#147)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
Berkeley Function Calling Leaderboard—25%
TheAgentCompany—1.7%

Reasoning Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 29.1 (#95), Amazon Nova Pro: 20.0 (#243)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Hard Prompts14221246
LiveBench Reasoning—32.6%
LiveBench Data Analysis—48.3%
Epoch Capabilities Index—123.8
LiveBench—43.5%

Math Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 39.1 (#114), Amazon Nova Pro: 28.5 (#243)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Math14311252
Omni-MATH—24.2%
LiveBench Math—38%

Knowledge Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 39.9 (#127), Amazon Nova Pro: 27.4 (#250)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Expert14311211
Humanity's Last Exam—4.4%
MMLU-Pro—67.3%
Confabulations—30.1%
Vectara Hallucination Rate—5.1%
GPQA (HELM)—44.6%
MMLU—82%

Multimodal Not comparable

Amazon Nova Experimental Chat 11 10: —, Amazon Nova Pro: 25.0 (#126)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Vision—980

Multilingual Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 51.9 (#98), Amazon Nova Pro: 39.7 (#223)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Non-English14051234
LMArena Chinese14631244
LMArena French14491271
LMArena German13951243
LMArena Japanese13831200
LMArena Korean13841203
LMArena Russian13941240
LMArena Spanish14441182

Instruction Following Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 73.2 (#122), Amazon Nova Pro: 64.9 (#226)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Instruction Following13871235
LiveBench Instruction Following—67.1%
IFEval—81.5%

Long Context Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 42.5 (#121), Amazon Nova Pro: 38.1 (#205)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Longer Query13951255

Writing & Preference Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 58.8 (#114), Amazon Nova Pro: 43.9 (#226)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Amazon Nova Pro
LMArena Text14151259
LMArena Creative Writing13491212
LMArena Multi-Turn13801246
Short-Story Creative Writing—60.5%
WildBench—77.7%
LiveBench Language—37%

Frequently asked questions

Is Amazon Nova Experimental Chat 11 10 better than Amazon Nova Pro?

Amazon Nova Experimental Chat 11 10 is the stronger model overall, scoring 43.0 to 31.0 on the Noometry Index.

Is Amazon Nova Experimental Chat 11 10 or Amazon Nova Pro better for coding?

Amazon Nova Experimental Chat 11 10 scores higher on coding benchmarks: 42.3 versus 35.1 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 11 10 and Amazon Nova Pro share?

17 benchmarks have published results for both models. Amazon Nova Experimental Chat 11 10 has 17 scored results on Noometry and Amazon Nova Pro has 38.

Related comparisons

Go deeper