Model comparison

Deepseek Coder v2 vs Wizardlm 70b

Deepseek Coder v2 is the stronger model overall, scoring 35.9 to 33.0 on the Noometry Index.

Last verified . 12 shared benchmarks.

Deepseek Coder v2 DeepSeek

35.9

Rank #220 Confirmed

Wizardlm 70b Microsoft

33.0

Rank #249 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Deepseek Coder v2 scores higher in 7 categories and Wizardlm 70b in 0 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in coding, where Deepseek Coder v2 leads 38.1 to 31.4.

Side by side

Deepseek Coder v2 and Wizardlm 70b specifications
Deepseek Coder v2Wizardlm 70b
ProviderDeepSeekMicrosoft
Noometry Index35.933.0
Released2024-06-17—
WeightsOpenOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2412

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Deepseek Coder v2 leads

Deepseek Coder v2: 38.1 (#183), Wizardlm 70b: 31.4 (#285)

Coding benchmarks
BenchmarkDeepseek Coder v2Wizardlm 70b
LMArena Coding12511081
BigCodeBench Instruct48.2%—
BigCodeBench Complete59.7%—
HumanEval+82.3%—
MBPP+75.1%—

Reasoning Deepseek Coder v2 leads

Deepseek Coder v2: 23.6 (#176), Wizardlm 70b: 20.7 (#234)

Reasoning benchmarks
BenchmarkDeepseek Coder v2Wizardlm 70b
LMArena Hard Prompts12071079
WinoGrande83.7%—

Math Deepseek Coder v2 leads

Deepseek Coder v2: 34.9 (#190), Wizardlm 70b: 32.2 (#218)

Math benchmarks
BenchmarkDeepseek Coder v2Wizardlm 70b
LMArena Math12411116
GSM8K94.5%—

Knowledge Not comparable

Deepseek Coder v2: 32.3 (#212), Wizardlm 70b: —

Knowledge benchmarks
BenchmarkDeepseek Coder v2Wizardlm 70b
LMArena Expert1181—
ARC (AI2) Challenge64.3%—

Multilingual Deepseek Coder v2 leads

Deepseek Coder v2: 36.3 (#240), Wizardlm 70b: 29.6 (#265)

Multilingual benchmarks
BenchmarkDeepseek Coder v2Wizardlm 70b
LMArena Non-English11821078
LMArena Chinese12011052
LMArena German11641083
LMArena Russian11881155
LMArena French1185—
LMArena Japanese1126—
LMArena Korean1104—
LMArena Spanish1153—

Instruction Following Deepseek Coder v2 leads

Deepseek Coder v2: 61.7 (#242), Wizardlm 70b: 56.3 (#273)

Instruction Following benchmarks
BenchmarkDeepseek Coder v2Wizardlm 70b
LMArena Instruction Following11801093

Long Context Deepseek Coder v2 leads

Deepseek Coder v2: 37.0 (#224), Wizardlm 70b: 33.3 (#263)

Long Context benchmarks
BenchmarkDeepseek Coder v2Wizardlm 70b
LMArena Longer Query12191097

Writing & Preference Deepseek Coder v2 leads

Deepseek Coder v2: 38.2 (#253), Wizardlm 70b: 34.8 (#269)

Writing & Preference benchmarks
BenchmarkDeepseek Coder v2Wizardlm 70b
LMArena Text11911120
LMArena Creative Writing11201149
LMArena Multi-Turn11771108

Frequently asked questions

Is Deepseek Coder v2 better than Wizardlm 70b?

Deepseek Coder v2 is the stronger model overall, scoring 35.9 to 33.0 on the Noometry Index.

Is Deepseek Coder v2 or Wizardlm 70b better for coding?

Deepseek Coder v2 scores higher on coding benchmarks: 38.1 versus 31.4 in the Noometry coding category.

How many benchmarks do Deepseek Coder v2 and Wizardlm 70b share?

12 benchmarks have published results for both models. Deepseek Coder v2 has 24 scored results on Noometry and Wizardlm 70b has 12.

Related comparisons

Go deeper