Model comparison

Amazon Nova Micro vs Qwen1.5 4b Chat

Amazon Nova Micro is the stronger model overall, scoring 30.4 to 28.8 on the Noometry Index.

Last verified . 13 shared benchmarks.

Amazon Nova Micro Amazon

30.4

Rank #294 Confirmed

Qwen1.5 4b Chat Alibaba (Qwen)

28.8

Rank #322 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Amazon Nova Micro scores higher in 6 categories and Qwen1.5 4b Chat in 2 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Amazon Nova Micro leads 39.5 to 23.8.
  • Qwen1.5 4b Chat has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Micro and Qwen1.5 4b Chat specifications
Amazon Nova MicroQwen1.5 4b Chat
ProviderAmazonAlibaba (Qwen)
Noometry Index30.428.8
Released2024-12-03—
WeightsProprietaryOpen
Context window128K—
Max output10K—
Input $ / M tokens$0.035—
Output $ / M tokens$0.14—
Results tracked3213

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Micro leads

Amazon Nova Micro: 30.5 (#295), Qwen1.5 4b Chat: 29.1 (#308)

Coding benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
LMArena Coding1218999
LiveBench Coding20.2%—

Agentic & Tool Use Not comparable

Amazon Nova Micro: 22.1 (#132), Qwen1.5 4b Chat: —

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
Berkeley Function Calling Leaderboard22.3%—

Reasoning Qwen1.5 4b Chat leads

Amazon Nova Micro: 17.4 (#294), Qwen1.5 4b Chat: 18.5 (#279)

Reasoning benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
LMArena Hard Prompts1191976
LiveBench Reasoning25.1%—
LiveBench Data Analysis34%—
LiveBench29.6%—

Math Qwen1.5 4b Chat leads

Amazon Nova Micro: 26.9 (#254), Qwen1.5 4b Chat: 30.4 (#234)

Math benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
LMArena Math12061026
Omni-MATH21.4%—
LiveBench Math34.5%—

Knowledge Amazon Nova Micro leads

Amazon Nova Micro: 29.6 (#237), Qwen1.5 4b Chat: 26.7 (#255)

Knowledge benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
LMArena Expert1184980
MMLU-Pro51.1%—
Vectara Hallucination Rate5.5%—
GPQA (HELM)38.3%—
MMLU70.8%—

Multilingual Amazon Nova Micro leads

Amazon Nova Micro: 36.5 (#239), Qwen1.5 4b Chat: 24.1 (#290)

Multilingual benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
LMArena Non-English1186979
LMArena Chinese12091024
LMArena German1192902
LMArena Russian1185952
LMArena French1238—
LMArena Japanese1154—
LMArena Korean1150—
LMArena Spanish1225—

Instruction Following Amazon Nova Micro leads

Amazon Nova Micro: 56.3 (#272), Qwen1.5 4b Chat: 49.0 (#300)

Instruction Following benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
LMArena Instruction Following1174978
LiveBench Instruction Following48%—
IFEval76%—

Long Context Amazon Nova Micro leads

Amazon Nova Micro: 36.5 (#229), Qwen1.5 4b Chat: 30.1 (#290)

Long Context benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
LMArena Longer Query1205988

Writing & Preference Amazon Nova Micro leads

Amazon Nova Micro: 39.5 (#247), Qwen1.5 4b Chat: 23.8 (#309)

Writing & Preference benchmarks
BenchmarkAmazon Nova MicroQwen1.5 4b Chat
LMArena Text1208997
LMArena Creative Writing1172969
LMArena Multi-Turn1178977
WildBench74.3%—
LiveBench Language15.8%—

Frequently asked questions

Is Amazon Nova Micro better than Qwen1.5 4b Chat?

Amazon Nova Micro is the stronger model overall, scoring 30.4 to 28.8 on the Noometry Index.

Is Amazon Nova Micro or Qwen1.5 4b Chat better for coding?

Amazon Nova Micro scores higher on coding benchmarks: 30.5 versus 29.1 in the Noometry coding category.

How many benchmarks do Amazon Nova Micro and Qwen1.5 4b Chat share?

13 benchmarks have published results for both models. Amazon Nova Micro has 32 scored results on Noometry and Qwen1.5 4b Chat has 13.

Related comparisons

Go deeper