Model comparison

Amazon Nova Pro vs Qwen1.5-14B

Qwen1.5-14B is the stronger model overall, scoring 32.7 to 31.0 on the Noometry Index.

Last verified . 17 shared benchmarks.

Amazon Nova Pro Amazon

31.0

Rank #281 Confirmed

Qwen1.5-14B Alibaba (Qwen)

32.7

Rank #253 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Amazon Nova Pro scores higher in 5 categories and Qwen1.5-14B in 3 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Amazon Nova Pro leads 43.9 to 33.6.
  • Qwen1.5-14B has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Pro and Qwen1.5-14B specifications
Amazon Nova ProQwen1.5-14B
ProviderAmazonAlibaba (Qwen)
Noometry Index31.032.7
Released2024-12-032024-02-04
WeightsProprietaryOpen
Context window300K—
Max output10K—
Input $ / M tokens$0.80—
Output $ / M tokens$3.20—
Results tracked3817

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Pro leads

Amazon Nova Pro: 35.1 (#229), Qwen1.5-14B: 33.1 (#263)

Coding benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Coding12701138
LiveBench Coding38.1%—

Agentic & Tool Use Not comparable

Amazon Nova Pro: 16.7 (#147), Qwen1.5-14B: —

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
Berkeley Function Calling Leaderboard25%—
TheAgentCompany1.7%—

Reasoning Qwen1.5-14B leads

Amazon Nova Pro: 20.0 (#243), Qwen1.5-14B: 21.4 (#223)

Reasoning benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Hard Prompts12461113
LiveBench Reasoning32.6%—
LiveBench Data Analysis48.3%—
Epoch Capabilities Index123.8—
LiveBench43.5%—

Math Qwen1.5-14B leads

Amazon Nova Pro: 28.5 (#243), Qwen1.5-14B: 32.4 (#215)

Math benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Math12521125
Omni-MATH24.2%—
LiveBench Math38%—

Knowledge Qwen1.5-14B leads

Amazon Nova Pro: 27.4 (#250), Qwen1.5-14B: 29.8 (#232)

Knowledge benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Expert12111094
MMLU82%68.6%
Humanity's Last Exam4.4%—
MMLU-Pro67.3%—
Confabulations30.1%—
Vectara Hallucination Rate5.1%—
GPQA (HELM)44.6%—

Multimodal Not comparable

Amazon Nova Pro: 25.0 (#126), Qwen1.5-14B: —

Multimodal benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Vision980—

Multilingual Amazon Nova Pro leads

Amazon Nova Pro: 39.7 (#223), Qwen1.5-14B: 30.7 (#262)

Multilingual benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Non-English12341095
LMArena Chinese12441147
LMArena French12711116
LMArena German12431043
LMArena Japanese12001019
LMArena Russian12401046
LMArena Spanish11821085
LMArena Korean1203—

Instruction Following Amazon Nova Pro leads

Amazon Nova Pro: 64.9 (#226), Qwen1.5-14B: 56.8 (#271)

Instruction Following benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Instruction Following12351102
LiveBench Instruction Following67.1%—
IFEval81.5%—

Long Context Amazon Nova Pro leads

Amazon Nova Pro: 38.1 (#205), Qwen1.5-14B: 33.7 (#257)

Long Context benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Longer Query12551113

Writing & Preference Amazon Nova Pro leads

Amazon Nova Pro: 43.9 (#226), Qwen1.5-14B: 33.6 (#276)

Writing & Preference benchmarks
BenchmarkAmazon Nova ProQwen1.5-14B
LMArena Text12591128
LMArena Creative Writing12121091
LMArena Multi-Turn12461110
Short-Story Creative Writing60.5%—
WildBench77.7%—
LiveBench Language37%—

Frequently asked questions

Is Amazon Nova Pro better than Qwen1.5-14B?

Qwen1.5-14B is the stronger model overall, scoring 32.7 to 31.0 on the Noometry Index.

Is Amazon Nova Pro or Qwen1.5-14B better for coding?

Amazon Nova Pro scores higher on coding benchmarks: 35.1 versus 33.1 in the Noometry coding category.

How many benchmarks do Amazon Nova Pro and Qwen1.5-14B share?

17 benchmarks have published results for both models. Amazon Nova Pro has 38 scored results on Noometry and Qwen1.5-14B has 17.

Related comparisons

Go deeper