Model comparison

DeepSeek LLM 67B vs Magistral Medium

Magistral Medium is the stronger model overall, scoring 35.2 to 24.9 on the Noometry Index.

Last verified . 10 shared benchmarks.

DeepSeek LLM 67B DeepSeek

24.9

Rank #347 Confirmed

Magistral Medium Mistral AI

35.2

Rank #227 Confirmed

Summary

  • They share 10 benchmarks with published results for both. DeepSeek LLM 67B scores higher in 1 category and Magistral Medium in 7 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Magistral Medium leads 33.5 to 7.0.

Side by side

DeepSeek LLM 67B and Magistral Medium specifications
DeepSeek LLM 67BMagistral Medium
ProviderDeepSeekMistral AI
Noometry Index24.935.2
Released2023-11-292025-03-17
WeightsOpenOpen
Context window—262K
Max output—16K
Input $ / M tokens—$2
Output $ / M tokens—$5
Results tracked1522

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Magistral Medium leads

DeepSeek LLM 67B: 31.9 (#278), Magistral Medium: 39.1 (#161)

Coding benchmarks
BenchmarkDeepSeek LLM 67BMagistral Medium
LMArena Coding10961319
SciCode—39.2%

Reasoning DeepSeek LLM 67B leads

DeepSeek LLM 67B: 16.5 (#304), Magistral Medium: 8.6 (#348)

Reasoning benchmarks
BenchmarkDeepSeek LLM 67BMagistral Medium
LMArena Hard Prompts10701267
ARC-AGI-2—0%
Kagi LLM Benchmark—16.2%
ARC-AGI-1—6.1%
CritPt—0.3%
Chess Puzzles0%—
Epoch Capabilities Index110.5—

Math Magistral Medium leads

DeepSeek LLM 67B: 8.7 (#324), Magistral Medium: 35.1 (#189)

Math benchmarks
BenchmarkDeepSeek LLM 67BMagistral Medium
LMArena Math11081250
OTIS Mock AIME 2024-20250.8%—
MATH Level 56.4%—

Knowledge Magistral Medium leads

DeepSeek LLM 67B: 7.0 (#313), Magistral Medium: 33.5 (#202)

Knowledge benchmarks
BenchmarkDeepSeek LLM 67BMagistral Medium
GPQA Diamond24.6%—
LMArena Expert—1223

Multilingual Magistral Medium leads

DeepSeek LLM 67B: 29.4 (#267), Magistral Medium: 39.6 (#224)

Multilingual benchmarks
BenchmarkDeepSeek LLM 67BMagistral Medium
LMArena Non-English10731232
LMArena Chinese11321227
LMArena French—1267
LMArena German—1248
LMArena Japanese—1175
LMArena Korean—1125
LMArena Russian—1224
LMArena Spanish—1271

Instruction Following Magistral Medium leads

DeepSeek LLM 67B: 55.4 (#277), Magistral Medium: 66.0 (#211)

Instruction Following benchmarks
BenchmarkDeepSeek LLM 67BMagistral Medium
LMArena Instruction Following10791254

Long Context Magistral Medium leads

DeepSeek LLM 67B: 33.1 (#265), Magistral Medium: 39.3 (#183)

Long Context benchmarks
BenchmarkDeepSeek LLM 67BMagistral Medium
LMArena Longer Query10921295

Writing & Preference Magistral Medium leads

DeepSeek LLM 67B: 31.6 (#282), Magistral Medium: 46.3 (#219)

Writing & Preference benchmarks
BenchmarkDeepSeek LLM 67BMagistral Medium
LMArena Text11051255
LMArena Creative Writing10671245
LMArena Multi-Turn10821275

Frequently asked questions

Is DeepSeek LLM 67B better than Magistral Medium?

Magistral Medium is the stronger model overall, scoring 35.2 to 24.9 on the Noometry Index.

Is DeepSeek LLM 67B or Magistral Medium better for coding?

Magistral Medium scores higher on coding benchmarks: 39.1 versus 31.9 in the Noometry coding category.

How many benchmarks do DeepSeek LLM 67B and Magistral Medium share?

10 benchmarks have published results for both models. DeepSeek LLM 67B has 15 scored results on Noometry and Magistral Medium has 22.

Related comparisons

Go deeper