Model comparison

Amazon Nova Micro vs Kimi K2.5 Instant

Kimi K2.5 Instant is the stronger model overall, scoring 43.6 to 30.4 on the Noometry Index.

Last verified . 16 shared benchmarks.

Amazon Nova Micro Amazon

30.4

Rank #294 Confirmed

Kimi K2.5 Instant Moonshot AI

43.6

Rank #89 Confirmed

Summary

  • They share 16 benchmarks with published results for both. Amazon Nova Micro scores higher in 0 categories and Kimi K2.5 Instant in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Kimi K2.5 Instant leads 60.6 to 39.5.
  • Kimi K2.5 Instant has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Micro and Kimi K2.5 Instant specifications
Amazon Nova MicroKimi K2.5 Instant
ProviderAmazonMoonshot AI
Noometry Index30.443.6
Released2024-12-03—
WeightsProprietaryOpen
Context window128K—
Max output10K—
Input $ / M tokens$0.035—
Output $ / M tokens$0.14—
Results tracked3218

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Kimi K2.5 Instant leads

Amazon Nova Micro: 30.5 (#295), Kimi K2.5 Instant: 42.6 (#97)

Coding benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Coding12181484
LMArena WebDev—1404
LiveBench Coding20.2%—

Agentic & Tool Use Not comparable

Amazon Nova Micro: 22.1 (#132), Kimi K2.5 Instant: —

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
Berkeley Function Calling Leaderboard22.3%—

Reasoning Kimi K2.5 Instant leads

Amazon Nova Micro: 17.4 (#294), Kimi K2.5 Instant: 29.7 (#90)

Reasoning benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Hard Prompts11911443
LiveBench Reasoning25.1%—
LiveBench Data Analysis34%—
LiveBench29.6%—

Math Kimi K2.5 Instant leads

Amazon Nova Micro: 26.9 (#254), Kimi K2.5 Instant: 39.4 (#105)

Math benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Math12061442
Omni-MATH21.4%—
LiveBench Math34.5%—

Knowledge Kimi K2.5 Instant leads

Amazon Nova Micro: 29.6 (#237), Kimi K2.5 Instant: 40.2 (#123)

Knowledge benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Expert11841440
MMLU-Pro51.1%—
Vectara Hallucination Rate5.5%—
GPQA (HELM)38.3%—
MMLU70.8%—

Multimodal Not comparable

Amazon Nova Micro: —, Kimi K2.5 Instant: 40.2 (#50)

Multimodal benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Vision—1254

Multilingual Kimi K2.5 Instant leads

Amazon Nova Micro: 36.5 (#239), Kimi K2.5 Instant: 52.0 (#94)

Multilingual benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Non-English11861406
LMArena Chinese12091449
LMArena French12381403
LMArena German11921413
LMArena Korean11501378
LMArena Russian11851404
LMArena Spanish12251447
LMArena Japanese1154—

Instruction Following Kimi K2.5 Instant leads

Amazon Nova Micro: 56.3 (#272), Kimi K2.5 Instant: 75.3 (#65)

Instruction Following benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Instruction Following11741430
LiveBench Instruction Following48%—
IFEval76%—

Long Context Kimi K2.5 Instant leads

Amazon Nova Micro: 36.5 (#229), Kimi K2.5 Instant: 43.9 (#83)

Long Context benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Longer Query12051435

Writing & Preference Kimi K2.5 Instant leads

Amazon Nova Micro: 39.5 (#247), Kimi K2.5 Instant: 60.6 (#95)

Writing & Preference benchmarks
BenchmarkAmazon Nova MicroKimi K2.5 Instant
LMArena Text12081420
LMArena Creative Writing11721381
LMArena Multi-Turn11781427
WildBench74.3%—
LiveBench Language15.8%—

Frequently asked questions

Is Amazon Nova Micro better than Kimi K2.5 Instant?

Kimi K2.5 Instant is the stronger model overall, scoring 43.6 to 30.4 on the Noometry Index.

Is Amazon Nova Micro or Kimi K2.5 Instant better for coding?

Kimi K2.5 Instant scores higher on coding benchmarks: 42.6 versus 30.5 in the Noometry coding category.

How many benchmarks do Amazon Nova Micro and Kimi K2.5 Instant share?

16 benchmarks have published results for both models. Amazon Nova Micro has 32 scored results on Noometry and Kimi K2.5 Instant has 18.

Related comparisons

Go deeper