Model comparison

Amazon Nova Micro vs DeepSeek-V3.1-Terminus

DeepSeek-V3.1-Terminus is the stronger model overall, scoring 43.1 to 30.4 on the Noometry Index. Amazon Nova Micro costs 7.4× less per token, which makes it the better buy when DeepSeek-V3.1-Terminus's lead doesn't matter for your workload.

Last verified . 10 shared benchmarks.

Amazon Nova Micro Amazon

30.4

Rank #294 Confirmed

DeepSeek-V3.1-Terminus DeepSeek

43.1

Rank #97 Confirmed

Summary

  • They share 10 benchmarks with published results for both. Amazon Nova Micro scores higher in 0 categories and DeepSeek-V3.1-Terminus in 7 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where DeepSeek-V3.1-Terminus leads 61.0 to 39.5.
  • Amazon Nova Micro is cheaper at $0.035 / $0.14 per million input/output tokens, against $0.27 / $1 for DeepSeek-V3.1-Terminus.
  • DeepSeek-V3.1-Terminus accepts more context: 164K tokens versus 128K.
  • DeepSeek-V3.1-Terminus has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Micro and DeepSeek-V3.1-Terminus specifications
Amazon Nova MicroDeepSeek-V3.1-Terminus
ProviderAmazonDeepSeek
Noometry Index30.443.1
Released2024-12-032025-09-22
WeightsProprietaryOpen
Context window128K164K
Max output10K147K
Input $ / M tokens$0.035$0.27
Output $ / M tokens$0.14$1
Results tracked3216

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding DeepSeek-V3.1-Terminus leads

Amazon Nova Micro: 30.5 (#295), DeepSeek-V3.1-Terminus: 42.0 (#113)

Coding benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
LMArena Coding12181426
SciCode—40.6%
LiveBench Coding20.2%—
ALE-Bench—745.17

Agentic & Tool Use Not comparable

Amazon Nova Micro: 22.1 (#132), DeepSeek-V3.1-Terminus: —

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
Berkeley Function Calling Leaderboard22.3%—

Reasoning DeepSeek-V3.1-Terminus leads

Amazon Nova Micro: 17.4 (#294), DeepSeek-V3.1-Terminus: 26.4 (#133)

Reasoning benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
LMArena Hard Prompts11911426
Kagi LLM Benchmark—57.4%
CritPt—1.7%
LiveBench Reasoning25.1%—
DTBench—81.3%
LiveBench Data Analysis34%—
LMCA—28.6%
LiveBench29.6%—

Math DeepSeek-V3.1-Terminus leads

Amazon Nova Micro: 26.9 (#254), DeepSeek-V3.1-Terminus: 38.5 (#137)

Math benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
LMArena Math12061402
Omni-MATH21.4%—
LiveBench Math34.5%—

Knowledge Not comparable

Amazon Nova Micro: 29.6 (#237), DeepSeek-V3.1-Terminus: —

Knowledge benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
MMLU-Pro51.1%—
Vectara Hallucination Rate5.5%—
GPQA (HELM)38.3%—
LMArena Expert1184—
MMLU70.8%—

Multilingual DeepSeek-V3.1-Terminus leads

Amazon Nova Micro: 36.5 (#239), DeepSeek-V3.1-Terminus: 52.1 (#92)

Multilingual benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
LMArena Non-English11861407
LMArena Russian11851436
LMArena Chinese1209—
LMArena French1238—
LMArena German1192—
LMArena Japanese1154—
LMArena Korean1150—
LMArena Spanish1225—

Instruction Following DeepSeek-V3.1-Terminus leads

Amazon Nova Micro: 56.3 (#272), DeepSeek-V3.1-Terminus: 74.0 (#106)

Instruction Following benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
LMArena Instruction Following11741404
LiveBench Instruction Following48%—
IFEval76%—

Long Context DeepSeek-V3.1-Terminus leads

Amazon Nova Micro: 36.5 (#229), DeepSeek-V3.1-Terminus: 43.4 (#97)

Long Context benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
LMArena Longer Query12051421

Writing & Preference DeepSeek-V3.1-Terminus leads

Amazon Nova Micro: 39.5 (#247), DeepSeek-V3.1-Terminus: 61.0 (#92)

Writing & Preference benchmarks
BenchmarkAmazon Nova MicroDeepSeek-V3.1-Terminus
LMArena Text12081419
LMArena Creative Writing11721403
LMArena Multi-Turn11781411
WildBench74.3%—
LiveBench Language15.8%—

Frequently asked questions

Is Amazon Nova Micro better than DeepSeek-V3.1-Terminus?

DeepSeek-V3.1-Terminus is the stronger model overall, scoring 43.1 to 30.4 on the Noometry Index. Amazon Nova Micro costs 7.4× less per token, which makes it the better buy when DeepSeek-V3.1-Terminus's lead doesn't matter for your workload.

Which is cheaper, Amazon Nova Micro or DeepSeek-V3.1-Terminus?

Amazon Nova Micro is cheaper. It lists at $0.035 per million input tokens and $0.14 per million output tokens; DeepSeek-V3.1-Terminus lists at $0.27 and $1.

Is Amazon Nova Micro or DeepSeek-V3.1-Terminus better for coding?

DeepSeek-V3.1-Terminus scores higher on coding benchmarks: 42.0 versus 30.5 in the Noometry coding category.

Which has the bigger context window?

DeepSeek-V3.1-Terminus does, with 164K tokens against 128K.

How many benchmarks do Amazon Nova Micro and DeepSeek-V3.1-Terminus share?

10 benchmarks have published results for both models. Amazon Nova Micro has 32 scored results on Noometry and DeepSeek-V3.1-Terminus has 16.

Related comparisons

Go deeper