Model comparison

Amazon Nova Experimental Chat 10 09 vs Grok 2 Mini 2024 08 13

Amazon Nova Experimental Chat 10 09 is the stronger model overall, scoring 41.9 to 37.7 on the Noometry Index.

Last verified . 9 shared benchmarks.

Grok 2 Mini 2024 08 13 xAI

37.7

Rank #198 Confirmed

Summary

  • They share 9 benchmarks with published results for both. Amazon Nova Experimental Chat 10 09 scores higher in 6 categories and Grok 2 Mini 2024 08 13 in 0 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Amazon Nova Experimental Chat 10 09 leads 54.7 to 47.3.

Side by side

Amazon Nova Experimental Chat 10 09 and Grok 2 Mini 2024 08 13 specifications
Amazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
ProviderAmazonxAI
Noometry Index41.937.7
Released—2024-08-13
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked917

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 40.2 (#145), Grok 2 Mini 2024 08 13: 37.0 (#199)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
LMArena Coding13701269

Reasoning Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 27.3 (#120), Grok 2 Mini 2024 08 13: 24.8 (#159)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
LMArena Hard Prompts13561255

Math Not comparable

Amazon Nova Experimental Chat 10 09: —, Grok 2 Mini 2024 08 13: 35.4 (#185)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
LMArena Math—1265

Knowledge Not comparable

Amazon Nova Experimental Chat 10 09: —, Grok 2 Mini 2024 08 13: 33.9 (#200)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
LMArena Expert—1238

Multilingual Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 47.3 (#150), Grok 2 Mini 2024 08 13: 41.4 (#208)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
LMArena Non-English13401257
LMArena Chinese13411262
LMArena French—1286
LMArena German—1273
LMArena Japanese—1213
LMArena Korean—1195
LMArena Russian—1261
LMArena Spanish—1279

Instruction Following Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 69.4 (#172), Grok 2 Mini 2024 08 13: 65.5 (#220)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
LMArena Instruction Following13151245

Long Context Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 40.5 (#152), Grok 2 Mini 2024 08 13: 38.4 (#196)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
LMArena Longer Query13331266

Writing & Preference Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 54.7 (#149), Grok 2 Mini 2024 08 13: 47.3 (#211)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Grok 2 Mini 2024 08 13
LMArena Text13641281
LMArena Creative Writing13071242
LMArena Multi-Turn13551265

Frequently asked questions

Is Amazon Nova Experimental Chat 10 09 better than Grok 2 Mini 2024 08 13?

Amazon Nova Experimental Chat 10 09 is the stronger model overall, scoring 41.9 to 37.7 on the Noometry Index.

Is Amazon Nova Experimental Chat 10 09 or Grok 2 Mini 2024 08 13 better for coding?

Amazon Nova Experimental Chat 10 09 scores higher on coding benchmarks: 40.2 versus 37.0 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 10 09 and Grok 2 Mini 2024 08 13 share?

9 benchmarks have published results for both models. Amazon Nova Experimental Chat 10 09 has 9 scored results on Noometry and Grok 2 Mini 2024 08 13 has 17.

Related comparisons

Go deeper