Model comparison

Amazon Nova Experimental Chat 10 09 vs Qwen Max

Amazon Nova Experimental Chat 10 09 is the stronger model overall, scoring 41.9 to 34.7 on the Noometry Index.

Last verified . 9 shared benchmarks.

Qwen Max Alibaba (Qwen)

34.7

Rank #230 Confirmed

Summary

  • They share 9 benchmarks with published results for both. Amazon Nova Experimental Chat 10 09 scores higher in 6 categories and Qwen Max in 0 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in coding, where Amazon Nova Experimental Chat 10 09 leads 40.2 to 30.7.

Side by side

Amazon Nova Experimental Chat 10 09 and Qwen Max specifications
Amazon Nova Experimental Chat 10 09Qwen Max
ProviderAmazonAlibaba (Qwen)
Noometry Index41.934.7
Released—2024-04-03
WeightsProprietaryProprietary
Context window—33K
Max output—8K
Input $ / M tokens—$1.60
Output $ / M tokens—$6.40
Results tracked923

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 40.2 (#145), Qwen Max: 30.7 (#292)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Qwen Max
LMArena Coding13701288
Aider Polyglot—21.8%

Reasoning Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 27.3 (#120), Qwen Max: 25.1 (#151)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Qwen Max
LMArena Hard Prompts13561269

Math Not comparable

Amazon Nova Experimental Chat 10 09: —, Qwen Max: 22.3 (#276)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Qwen Max
OTIS Mock AIME 2024-2025—16.1%
LMArena Math—1275
MATH Level 5—67.2%
FrontierMath (Feb 2025 set)—1%

Knowledge Not comparable

Amazon Nova Experimental Chat 10 09: —, Qwen Max: 30.3 (#228)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Qwen Max
GPQA Diamond—56.1%
LMArena Expert—1248

Multilingual Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 47.3 (#150), Qwen Max: 41.8 (#202)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Qwen Max
LMArena Non-English13401263
LMArena Chinese13411254
LMArena French—1330
LMArena German—1254
LMArena Japanese—1205
LMArena Korean—1142
LMArena Russian—1274
LMArena Spanish—1290

Instruction Following Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 69.4 (#172), Qwen Max: 66.5 (#208)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Qwen Max
LMArena Instruction Following13151262

Long Context Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 40.5 (#152), Qwen Max: 39.4 (#180)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Qwen Max
LMArena Longer Query13331288
Fiction.LiveBench—66.7%

Writing & Preference Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 54.7 (#149), Qwen Max: 47.8 (#205)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Qwen Max
LMArena Text13641282
LMArena Creative Writing13071248
LMArena Multi-Turn13551277

Frequently asked questions

Is Amazon Nova Experimental Chat 10 09 better than Qwen Max?

Amazon Nova Experimental Chat 10 09 is the stronger model overall, scoring 41.9 to 34.7 on the Noometry Index.

Is Amazon Nova Experimental Chat 10 09 or Qwen Max better for coding?

Amazon Nova Experimental Chat 10 09 scores higher on coding benchmarks: 40.2 versus 30.7 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 10 09 and Qwen Max share?

9 benchmarks have published results for both models. Amazon Nova Experimental Chat 10 09 has 9 scored results on Noometry and Qwen Max has 23.

Related comparisons

Go deeper