Model comparison

Deepseek Coder v2 vs Mistral

Deepseek Coder v2 is the stronger model overall, scoring 35.9 to 29.9 on the Noometry Index.

Last verified . 17 shared benchmarks.

Deepseek Coder v2 DeepSeek

35.9

Rank #220 Confirmed

Mistral Mistral AI

29.9

Rank #303 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Deepseek Coder v2 scores higher in 8 categories and Mistral in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Deepseek Coder v2 leads 32.3 to 16.6.
  • Deepseek Coder v2 has downloadable open weights; the other is API-only.

Side by side

Deepseek Coder v2 and Mistral specifications
Deepseek Coder v2Mistral
ProviderDeepSeekMistral AI
Noometry Index35.929.9
Released2024-06-17—
WeightsOpenProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2422

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Deepseek Coder v2 leads

Deepseek Coder v2: 38.1 (#183), Mistral: 33.8 (#250)

Coding benchmarks
BenchmarkDeepseek Coder v2Mistral
LMArena Coding12511162
BigCodeBench Instruct48.2%—
BigCodeBench Complete59.7%—
HumanEval+82.3%—
MBPP+75.1%—

Reasoning Deepseek Coder v2 leads

Deepseek Coder v2: 23.6 (#176), Mistral: 22.2 (#200)

Reasoning benchmarks
BenchmarkDeepseek Coder v2Mistral
LMArena Hard Prompts12071149
WinoGrande83.7%—

Math Deepseek Coder v2 leads

Deepseek Coder v2: 34.9 (#190), Mistral: 22.3 (#278)

Math benchmarks
BenchmarkDeepseek Coder v2Mistral
LMArena Math12411180
Omni-MATH—7.2%
GSM8K94.5%—

Knowledge Deepseek Coder v2 leads

Deepseek Coder v2: 32.3 (#212), Mistral: 16.6 (#288)

Knowledge benchmarks
BenchmarkDeepseek Coder v2Mistral
LMArena Expert11811125
MMLU-Pro—27.7%
GPQA (HELM)—30.3%
ARC (AI2) Challenge64.3%—

Multilingual Deepseek Coder v2 leads

Deepseek Coder v2: 36.3 (#240), Mistral: 32.8 (#254)

Multilingual benchmarks
BenchmarkDeepseek Coder v2Mistral
LMArena Non-English11821129
LMArena Chinese12011109
LMArena French11851180
LMArena German11641155
LMArena Japanese11261013
LMArena Korean11041032
LMArena Russian11881168
LMArena Spanish11531143

Instruction Following Deepseek Coder v2 leads

Deepseek Coder v2: 61.7 (#242), Mistral: 52.6 (#288)

Instruction Following benchmarks
BenchmarkDeepseek Coder v2Mistral
LMArena Instruction Following11801152
IFEval—56.8%

Long Context Deepseek Coder v2 leads

Deepseek Coder v2: 37.0 (#224), Mistral: 35.0 (#245)

Long Context benchmarks
BenchmarkDeepseek Coder v2Mistral
LMArena Longer Query12191153

Writing & Preference Deepseek Coder v2 leads

Deepseek Coder v2: 38.2 (#253), Mistral: 37.0 (#260)

Writing & Preference benchmarks
BenchmarkDeepseek Coder v2Mistral
LMArena Text11911165
LMArena Creative Writing11201158
LMArena Multi-Turn11771147
WildBench—66%

Frequently asked questions

Is Deepseek Coder v2 better than Mistral?

Deepseek Coder v2 is the stronger model overall, scoring 35.9 to 29.9 on the Noometry Index.

Is Deepseek Coder v2 or Mistral better for coding?

Deepseek Coder v2 scores higher on coding benchmarks: 38.1 versus 33.8 in the Noometry coding category.

How many benchmarks do Deepseek Coder v2 and Mistral share?

17 benchmarks have published results for both models. Deepseek Coder v2 has 24 scored results on Noometry and Mistral has 22.

Related comparisons

Go deeper