Model comparison

DeepSeek LLM 67B vs Nova Premier 1.0

Nova Premier 1.0 is the stronger model overall, scoring 38.3 to 24.9 on the Noometry Index.

Last verified . 0 shared benchmarks.

DeepSeek LLM 67B DeepSeek

24.9

Rank #347 Confirmed

Nova Premier 1.0 Amazon

38.3

Rank #189 Confirmed

Summary

  • The widest gap is in knowledge, where Nova Premier 1.0 leads 35.8 to 7.0.
  • DeepSeek LLM 67B has downloadable open weights; the other is API-only.

Side by side

DeepSeek LLM 67B and Nova Premier 1.0 specifications
DeepSeek LLM 67BNova Premier 1.0
ProviderDeepSeekAmazon
Noometry Index24.938.3
Released2023-11-292025-04-30
WeightsOpenProprietary
Context window—1M
Max output—10K
Input $ / M tokens—$2.50
Output $ / M tokens—$12.50
Results tracked156

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

DeepSeek LLM 67B: 31.9 (#278), Nova Premier 1.0: —

Coding benchmarks
BenchmarkDeepSeek LLM 67BNova Premier 1.0
LMArena Coding1096—

Reasoning Nova Premier 1.0 leads

DeepSeek LLM 67B: 16.5 (#304), Nova Premier 1.0: 23.0 (#185)

Reasoning benchmarks
BenchmarkDeepSeek LLM 67BNova Premier 1.0
Kagi LLM Benchmark—44.8%
Chess Puzzles0%—
LMArena Hard Prompts1070—
Epoch Capabilities Index110.5—

Math Nova Premier 1.0 leads

DeepSeek LLM 67B: 8.7 (#324), Nova Premier 1.0: 33.8 (#199)

Math benchmarks
BenchmarkDeepSeek LLM 67BNova Premier 1.0
OTIS Mock AIME 2024-20250.8%—
Omni-MATH—35%
LMArena Math1108—
MATH Level 56.4%—

Knowledge Nova Premier 1.0 leads

DeepSeek LLM 67B: 7.0 (#313), Nova Premier 1.0: 35.8 (#180)

Knowledge benchmarks
BenchmarkDeepSeek LLM 67BNova Premier 1.0
GPQA Diamond24.6%—
MMLU-Pro—72.6%
GPQA (HELM)—51.8%

Multilingual Not comparable

DeepSeek LLM 67B: 29.4 (#267), Nova Premier 1.0: —

Multilingual benchmarks
BenchmarkDeepSeek LLM 67BNova Premier 1.0
LMArena Non-English1073—
LMArena Chinese1132—

Instruction Following Nova Premier 1.0 leads

DeepSeek LLM 67B: 55.4 (#277), Nova Premier 1.0: 66.8 (#204)

Instruction Following benchmarks
BenchmarkDeepSeek LLM 67BNova Premier 1.0
IFEval—80.3%
LMArena Instruction Following1079—

Long Context Not comparable

DeepSeek LLM 67B: 33.1 (#265), Nova Premier 1.0: —

Long Context benchmarks
BenchmarkDeepSeek LLM 67BNova Premier 1.0
LMArena Longer Query1092—

Writing & Preference Nova Premier 1.0 leads

DeepSeek LLM 67B: 31.6 (#282), Nova Premier 1.0: 51.0 (#178)

Writing & Preference benchmarks
BenchmarkDeepSeek LLM 67BNova Premier 1.0
LMArena Text1105—
LMArena Creative Writing1067—
WildBench—78.8%
LMArena Multi-Turn1082—

Frequently asked questions

Is DeepSeek LLM 67B better than Nova Premier 1.0?

Nova Premier 1.0 is the stronger model overall, scoring 38.3 to 24.9 on the Noometry Index.

How many benchmarks do DeepSeek LLM 67B and Nova Premier 1.0 share?

0 benchmarks have published results for both models. DeepSeek LLM 67B has 15 scored results on Noometry and Nova Premier 1.0 has 6.

Related comparisons

Go deeper