Model comparison

Amazon Nova Experimental Chat 26 01 10 vs Mistral Large 4

Amazon Nova Experimental Chat 26 01 10 and Mistral Large 4 score almost the same on the Noometry Index (42.8 vs 43.1), so choose on price, context window or the category you care about most.

Last verified . 12 shared benchmarks.

Mistral Large 4 Mistral AI

43.1

Rank #99 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 26 01 10 scores higher in 2 categories and Mistral Large 4 in 6 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Amazon Nova Experimental Chat 26 01 10 leads 28.9 to 22.5.

Side by side

Amazon Nova Experimental Chat 26 01 10 and Mistral Large 4 specifications
Amazon Nova Experimental Chat 26 01 10Mistral Large 4
ProviderAmazonMistral AI
Noometry Index42.843.1
Released—2026-10-06
WeightsProprietaryProprietary
Context window—1.05M
Max output—262K
Input $ / M tokens—$0.68
Output $ / M tokens—$2.09
Results tracked1315

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Mistral Large 4 leads

Amazon Nova Experimental Chat 26 01 10: 42.7 (#96), Mistral Large 4: 48.6 (#57)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Mistral Large 4
LMArena Coding14471475
LMArena WebDev—1541

Reasoning Amazon Nova Experimental Chat 26 01 10 leads

Amazon Nova Experimental Chat 26 01 10: 28.9 (#98), Mistral Large 4: 22.5 (#192)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Mistral Large 4
LMArena Hard Prompts14151444
NYT Connections (extended)—27.4%

Math Mistral Large 4 leads

Amazon Nova Experimental Chat 26 01 10: 38.5 (#136), Mistral Large 4: 40.4 (#91)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Mistral Large 4
LMArena Math14041488

Knowledge Amazon Nova Experimental Chat 26 01 10 leads

Amazon Nova Experimental Chat 26 01 10: 40.3 (#120), Mistral Large 4: 36.6 (#166)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Mistral Large 4
LMArena Expert14441447
SimpleQA Verified—20%

Multilingual Mistral Large 4 leads

Amazon Nova Experimental Chat 26 01 10: 50.2 (#126), Mistral Large 4: 52.6 (#82)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Mistral Large 4
LMArena Non-English13811415
LMArena Chinese13721491
LMArena Russian13911414
LMArena Spanish1390—

Instruction Following Mistral Large 4 leads

Amazon Nova Experimental Chat 26 01 10: 72.9 (#126), Mistral Large 4: 75.0 (#76)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Mistral Large 4
LMArena Instruction Following13811424

Long Context Too close to call

Amazon Nova Experimental Chat 26 01 10: 42.7 (#119), Mistral Large 4: 43.6 (#89)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Mistral Large 4
LMArena Longer Query14001429

Writing & Preference Mistral Large 4 leads

Amazon Nova Experimental Chat 26 01 10: 57.4 (#129), Mistral Large 4: 60.4 (#97)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Mistral Large 4
LMArena Text13961427
LMArena Creative Writing13311361
LMArena Multi-Turn13801424

Frequently asked questions

Is Amazon Nova Experimental Chat 26 01 10 better than Mistral Large 4?

Amazon Nova Experimental Chat 26 01 10 and Mistral Large 4 score almost the same on the Noometry Index (42.8 vs 43.1), so choose on price, context window or the category you care about most.

Is Amazon Nova Experimental Chat 26 01 10 or Mistral Large 4 better for coding?

Mistral Large 4 scores higher on coding benchmarks: 48.6 versus 42.7 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 26 01 10 and Mistral Large 4 share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 26 01 10 has 13 scored results on Noometry and Mistral Large 4 has 15.

Related comparisons

Go deeper