Model comparison

Amazon Nova Experimental Chat 10 20 vs Gemini 1.5 Pro (May 2024)

Amazon Nova Experimental Chat 10 20 is the stronger model overall, scoring 42.1 to 32.1 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini 1.5 Pro (May 2024) Google

32.1

Rank #261 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Amazon Nova Experimental Chat 10 20 scores higher in 8 categories and Gemini 1.5 Pro (May 2024) in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Amazon Nova Experimental Chat 10 20 leads 28.4 to 12.3.

Side by side

Amazon Nova Experimental Chat 10 20 and Gemini 1.5 Pro (May 2024) specifications
Amazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
ProviderAmazonGoogle
Noometry Index42.132.1
Released—2024-02-15
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked1745

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 41.6 (#123), Gemini 1.5 Pro (May 2024): 34.2 (#241)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Coding14121294
WeirdML—22.2%
BigCodeBench Instruct—43.8%
BigCodeBench Complete—57.5%
CadEval—34%
HumanEval+—79.3%
MBPP+—74.6%

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 10 20: —, Gemini 1.5 Pro (May 2024): 17.9 (#145)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
TheAgentCompany—3.4%
Cybench—7.5%
BALROG—21%

Reasoning Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 28.4 (#106), Gemini 1.5 Pro (May 2024): 12.3 (#338)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Hard Prompts13961296
ARC-AGI-2—0.8%
SimpleBench—27.1%
DTBench—59%
BIG-Bench Hard—89.2%
Epoch Capabilities Index—131.73
ForecastBench—58.4

Math Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 39.0 (#119), Gemini 1.5 Pro (May 2024): 25.8 (#266)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Math14251315
OTIS Mock AIME 2024-2025—23.1%
Omni-MATH—36.4%
MATH Level 5—70.4%

Knowledge Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 38.5 (#144), Gemini 1.5 Pro (May 2024): 29.4 (#239)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Expert13861279
GPQA Diamond—57.2%
Humanity's Last Exam—4.6%
MMLU-Pro—73.7%
Confabulations—13.5%
GPQA (HELM)—53.4%
MMLU—86.9%

Multimodal Not comparable

Amazon Nova Experimental Chat 10 20: —, Gemini 1.5 Pro (May 2024): 36.8 (#77)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Vision—1161
Video-MME—75%

Multilingual Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 49.5 (#131), Gemini 1.5 Pro (May 2024): 45.3 (#174)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Non-English13721312
LMArena Chinese14041331
LMArena French14251302
LMArena German13911286
LMArena Japanese13601292
LMArena Korean13241298
LMArena Russian13711320
LMArena Spanish13821311

Instruction Following Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 72.1 (#141), Gemini 1.5 Pro (May 2024): 68.6 (#185)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Instruction Following13651297
IFEval—83.7%

Long Context Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 41.7 (#133), Gemini 1.5 Pro (May 2024): 39.8 (#169)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Longer Query13701308

Writing & Preference Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 56.6 (#136), Gemini 1.5 Pro (May 2024): 52.4 (#172)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 1.5 Pro (May 2024)
LMArena Text13941319
LMArena Creative Writing13181333
LMArena Multi-Turn13641296
WildBench—81.3%

Frequently asked questions

Is Amazon Nova Experimental Chat 10 20 better than Gemini 1.5 Pro (May 2024)?

Amazon Nova Experimental Chat 10 20 is the stronger model overall, scoring 42.1 to 32.1 on the Noometry Index.

Is Amazon Nova Experimental Chat 10 20 or Gemini 1.5 Pro (May 2024) better for coding?

Amazon Nova Experimental Chat 10 20 scores higher on coding benchmarks: 41.6 versus 34.2 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 10 20 and Gemini 1.5 Pro (May 2024) share?

17 benchmarks have published results for both models. Amazon Nova Experimental Chat 10 20 has 17 scored results on Noometry and Gemini 1.5 Pro (May 2024) has 45.

Related comparisons

Go deeper