Model comparison

Amazon Nova Experimental Chat 10 20 vs DeepSeek LLM 67B

Amazon Nova Experimental Chat 10 20 is the stronger model overall, scoring 42.1 to 24.9 on the Noometry Index.

Last verified . 10 shared benchmarks.

DeepSeek LLM 67B DeepSeek

24.9

Rank #347 Confirmed

Summary

  • They share 10 benchmarks with published results for both. Amazon Nova Experimental Chat 10 20 scores higher in 8 categories and DeepSeek LLM 67B in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Amazon Nova Experimental Chat 10 20 leads 38.5 to 7.0.
  • DeepSeek LLM 67B has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Experimental Chat 10 20 and DeepSeek LLM 67B specifications
Amazon Nova Experimental Chat 10 20DeepSeek LLM 67B
ProviderAmazonDeepSeek
Noometry Index42.124.9
Released—2023-11-29
WeightsProprietaryOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked1715

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 41.6 (#123), DeepSeek LLM 67B: 31.9 (#278)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20DeepSeek LLM 67B
LMArena Coding14121096

Reasoning Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 28.4 (#106), DeepSeek LLM 67B: 16.5 (#304)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20DeepSeek LLM 67B
LMArena Hard Prompts13961070
Chess Puzzles—0%
Epoch Capabilities Index—110.5

Math Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 39.0 (#119), DeepSeek LLM 67B: 8.7 (#324)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20DeepSeek LLM 67B
LMArena Math14251108
OTIS Mock AIME 2024-2025—0.8%
MATH Level 5—6.4%

Knowledge Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 38.5 (#144), DeepSeek LLM 67B: 7.0 (#313)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20DeepSeek LLM 67B
GPQA Diamond—24.6%
LMArena Expert1386—

Multilingual Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 49.5 (#131), DeepSeek LLM 67B: 29.4 (#267)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20DeepSeek LLM 67B
LMArena Non-English13721073
LMArena Chinese14041132
LMArena French1425—
LMArena German1391—
LMArena Japanese1360—
LMArena Korean1324—
LMArena Russian1371—
LMArena Spanish1382—

Instruction Following Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 72.1 (#141), DeepSeek LLM 67B: 55.4 (#277)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20DeepSeek LLM 67B
LMArena Instruction Following13651079

Long Context Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 41.7 (#133), DeepSeek LLM 67B: 33.1 (#265)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20DeepSeek LLM 67B
LMArena Longer Query13701092

Writing & Preference Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 56.6 (#136), DeepSeek LLM 67B: 31.6 (#282)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20DeepSeek LLM 67B
LMArena Text13941105
LMArena Creative Writing13181067
LMArena Multi-Turn13641082

Frequently asked questions

Is Amazon Nova Experimental Chat 10 20 better than DeepSeek LLM 67B?

Amazon Nova Experimental Chat 10 20 is the stronger model overall, scoring 42.1 to 24.9 on the Noometry Index.

Is Amazon Nova Experimental Chat 10 20 or DeepSeek LLM 67B better for coding?

Amazon Nova Experimental Chat 10 20 scores higher on coding benchmarks: 41.6 versus 31.9 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 10 20 and DeepSeek LLM 67B share?

10 benchmarks have published results for both models. Amazon Nova Experimental Chat 10 20 has 17 scored results on Noometry and DeepSeek LLM 67B has 15.

Related comparisons

Go deeper