Model comparison

Amazon Nova Micro vs Llama 13b

Amazon Nova Micro is the stronger model overall, scoring 30.4 to 24.4 on the Noometry Index.

Last verified . 9 shared benchmarks.

Amazon Nova Micro Amazon

30.4

Rank #294 Confirmed

Llama 13b Meta

24.4

Rank #348 Confirmed

Summary

  • They share 9 benchmarks with published results for both. Amazon Nova Micro scores higher in 6 categories and Llama 13b in 0 categories; 5 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Amazon Nova Micro leads 39.5 to 13.8.
  • Llama 13b has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Micro and Llama 13b specifications
Amazon Nova MicroLlama 13b
ProviderAmazonMeta
Noometry Index30.424.4
Released2024-12-032023-02-24
WeightsProprietaryOpen
Context window128K—
Max output10K—
Input $ / M tokens$0.035—
Output $ / M tokens$0.14—
Results tracked3221

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Micro leads

Amazon Nova Micro: 30.5 (#295), Llama 13b: 21.4 (#337)

Coding benchmarks
BenchmarkAmazon Nova MicroLlama 13b
LMArena Coding1218683
LiveBench Coding20.2%—

Agentic & Tool Use Not comparable

Amazon Nova Micro: 22.1 (#132), Llama 13b: —

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova MicroLlama 13b
Berkeley Function Calling Leaderboard22.3%—

Reasoning Amazon Nova Micro leads

Amazon Nova Micro: 17.4 (#294), Llama 13b: 14.0 (#329)

Reasoning benchmarks
BenchmarkAmazon Nova MicroLlama 13b
LMArena Hard Prompts1191728
LiveBench Reasoning25.1%—
LiveBench Data Analysis34%—
BIG-Bench Hard—37.9%
Epoch Capabilities Index—100.58
HellaSwag—79.2%
LAMBADA—75.2%
LiveBench29.6%—
PIQA—80.1%
WinoGrande—73%

Math Too close to call

Amazon Nova Micro: 26.9 (#254), Llama 13b: 26.7 (#256)

Math benchmarks
BenchmarkAmazon Nova MicroLlama 13b
LMArena Math1206838
Omni-MATH21.4%—
LiveBench Math34.5%—
GSM8K—20.6%

Knowledge Not comparable

Amazon Nova Micro: 29.6 (#237), Llama 13b: —

Knowledge benchmarks
BenchmarkAmazon Nova MicroLlama 13b
MMLU70.8%47.7%
MMLU-Pro51.1%—
Vectara Hallucination Rate5.5%—
GPQA (HELM)38.3%—
LMArena Expert1184—
ARC (AI2) Challenge—52.7%
BoolQ—78.7%
OpenBookQA—56.4%
TriviaQA—77.9%

Multimodal Not comparable

Amazon Nova Micro: —, Llama 13b: —

Multimodal benchmarks
BenchmarkAmazon Nova MicroLlama 13b
ScienceQA—43.3%

Multilingual Amazon Nova Micro leads

Amazon Nova Micro: 36.5 (#239), Llama 13b: 16.6 (#297)

Multilingual benchmarks
BenchmarkAmazon Nova MicroLlama 13b
LMArena Non-English1186819
LMArena Chinese1209—
LMArena French1238—
LMArena German1192—
LMArena Japanese1154—
LMArena Korean1150—
LMArena Russian1185—
LMArena Spanish1225—

Instruction Following Amazon Nova Micro leads

Amazon Nova Micro: 56.3 (#272), Llama 13b: 36.7 (#305)

Instruction Following benchmarks
BenchmarkAmazon Nova MicroLlama 13b
LMArena Instruction Following1174781
LiveBench Instruction Following48%—
IFEval76%—

Long Context Not comparable

Amazon Nova Micro: 36.5 (#229), Llama 13b: —

Long Context benchmarks
BenchmarkAmazon Nova MicroLlama 13b
LMArena Longer Query1205—

Writing & Preference Amazon Nova Micro leads

Amazon Nova Micro: 39.5 (#247), Llama 13b: 13.8 (#312)

Writing & Preference benchmarks
BenchmarkAmazon Nova MicroLlama 13b
LMArena Text1208834
LMArena Creative Writing1172794
LMArena Multi-Turn1178753
WildBench74.3%—
LiveBench Language15.8%—

Frequently asked questions

Is Amazon Nova Micro better than Llama 13b?

Amazon Nova Micro is the stronger model overall, scoring 30.4 to 24.4 on the Noometry Index.

Is Amazon Nova Micro or Llama 13b better for coding?

Amazon Nova Micro scores higher on coding benchmarks: 30.5 versus 21.4 in the Noometry coding category.

How many benchmarks do Amazon Nova Micro and Llama 13b share?

9 benchmarks have published results for both models. Amazon Nova Micro has 32 scored results on Noometry and Llama 13b has 21.

Related comparisons

Go deeper