Model comparison

Amazon Nova Micro vs Granite 3.1 2b Instruct

Granite 3.1 2b Instruct is the stronger model overall, scoring 33.2 to 30.4 on the Noometry Index.

Last verified . 12 shared benchmarks.

Amazon Nova Micro Amazon

30.4

Rank #294 Confirmed

Granite 3.1 2b Instruct IBM

33.2

Rank #247 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Micro scores higher in 3 categories and Granite 3.1 2b Instruct in 5 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in multilingual, where Amazon Nova Micro leads 36.5 to 29.1.
  • Granite 3.1 2b Instruct has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Micro and Granite 3.1 2b Instruct specifications
Amazon Nova MicroGranite 3.1 2b Instruct
ProviderAmazonIBM
Noometry Index30.433.2
Released2024-12-03—
WeightsProprietaryOpen
Context window128K—
Max output10K—
Input $ / M tokens$0.035—
Output $ / M tokens$0.14—
Results tracked3212

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Granite 3.1 2b Instruct leads

Amazon Nova Micro: 30.5 (#295), Granite 3.1 2b Instruct: 33.4 (#257)

Coding benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
LMArena Coding12181149
LiveBench Coding20.2%—

Agentic & Tool Use Not comparable

Amazon Nova Micro: 22.1 (#132), Granite 3.1 2b Instruct: —

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
Berkeley Function Calling Leaderboard22.3%—

Reasoning Granite 3.1 2b Instruct leads

Amazon Nova Micro: 17.4 (#294), Granite 3.1 2b Instruct: 22.0 (#209)

Reasoning benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
LMArena Hard Prompts11911138
LiveBench Reasoning25.1%—
LiveBench Data Analysis34%—
LiveBench29.6%—

Math Granite 3.1 2b Instruct leads

Amazon Nova Micro: 26.9 (#254), Granite 3.1 2b Instruct: 33.1 (#206)

Math benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
LMArena Math12061159
Omni-MATH21.4%—
LiveBench Math34.5%—

Knowledge Granite 3.1 2b Instruct leads

Amazon Nova Micro: 29.6 (#237), Granite 3.1 2b Instruct: 30.8 (#224)

Knowledge benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
LMArena Expert11841131
MMLU-Pro51.1%—
Vectara Hallucination Rate5.5%—
GPQA (HELM)38.3%—
MMLU70.8%—

Multilingual Amazon Nova Micro leads

Amazon Nova Micro: 36.5 (#239), Granite 3.1 2b Instruct: 29.1 (#269)

Multilingual benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
LMArena Non-English11861068
LMArena Chinese12091139
LMArena Russian11851063
LMArena French1238—
LMArena German1192—
LMArena Japanese1154—
LMArena Korean1150—
LMArena Spanish1225—

Instruction Following Granite 3.1 2b Instruct leads

Amazon Nova Micro: 56.3 (#272), Granite 3.1 2b Instruct: 57.7 (#264)

Instruction Following benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
LMArena Instruction Following11741116
LiveBench Instruction Following48%—
IFEval76%—

Long Context Amazon Nova Micro leads

Amazon Nova Micro: 36.5 (#229), Granite 3.1 2b Instruct: 35.0 (#244)

Long Context benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
LMArena Longer Query12051155

Writing & Preference Amazon Nova Micro leads

Amazon Nova Micro: 39.5 (#247), Granite 3.1 2b Instruct: 34.1 (#274)

Writing & Preference benchmarks
BenchmarkAmazon Nova MicroGranite 3.1 2b Instruct
LMArena Text12081127
LMArena Creative Writing11721116
LMArena Multi-Turn11781099
WildBench74.3%—
LiveBench Language15.8%—

Frequently asked questions

Is Amazon Nova Micro better than Granite 3.1 2b Instruct?

Granite 3.1 2b Instruct is the stronger model overall, scoring 33.2 to 30.4 on the Noometry Index.

Is Amazon Nova Micro or Granite 3.1 2b Instruct better for coding?

Granite 3.1 2b Instruct scores higher on coding benchmarks: 33.4 versus 30.5 in the Noometry coding category.

How many benchmarks do Amazon Nova Micro and Granite 3.1 2b Instruct share?

12 benchmarks have published results for both models. Amazon Nova Micro has 32 scored results on Noometry and Granite 3.1 2b Instruct has 12.

Related comparisons

Go deeper