Model comparison

Deepseek Coder v2 vs Granite 4.2 30b

Granite 4.2 30b is the stronger model overall, scoring 41.8 to 35.9 on the Noometry Index.

Last verified . 11 shared benchmarks.

Deepseek Coder v2 DeepSeek

35.9

Rank #220 Confirmed

Granite 4.2 30b IBM

41.8

Rank #130 Confirmed

Summary

  • They share 11 benchmarks with published results for both. Deepseek Coder v2 scores higher in 0 categories and Granite 4.2 30b in 7 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Granite 4.2 30b leads 53.8 to 38.2.

Side by side

Deepseek Coder v2 and Granite 4.2 30b specifications
Deepseek Coder v2Granite 4.2 30b
ProviderDeepSeekIBM
Noometry Index35.941.8
Released2024-06-17—
WeightsOpenOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2411

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Granite 4.2 30b leads

Deepseek Coder v2: 38.1 (#183), Granite 4.2 30b: 41.0 (#126)

Coding benchmarks
BenchmarkDeepseek Coder v2Granite 4.2 30b
LMArena Coding12511396
BigCodeBench Instruct48.2%—
BigCodeBench Complete59.7%—
HumanEval+82.3%—
MBPP+75.1%—

Reasoning Granite 4.2 30b leads

Deepseek Coder v2: 23.6 (#176), Granite 4.2 30b: 27.8 (#112)

Reasoning benchmarks
BenchmarkDeepseek Coder v2Granite 4.2 30b
LMArena Hard Prompts12071374
WinoGrande83.7%—

Math Not comparable

Deepseek Coder v2: 34.9 (#190), Granite 4.2 30b: —

Math benchmarks
BenchmarkDeepseek Coder v2Granite 4.2 30b
LMArena Math1241—
GSM8K94.5%—

Knowledge Granite 4.2 30b leads

Deepseek Coder v2: 32.3 (#212), Granite 4.2 30b: 39.1 (#138)

Knowledge benchmarks
BenchmarkDeepseek Coder v2Granite 4.2 30b
LMArena Expert11811406
ARC (AI2) Challenge64.3%—

Multilingual Granite 4.2 30b leads

Deepseek Coder v2: 36.3 (#240), Granite 4.2 30b: 47.3 (#151)

Multilingual benchmarks
BenchmarkDeepseek Coder v2Granite 4.2 30b
LMArena Non-English11821340
LMArena Chinese12011414
LMArena Russian11881343
LMArena French1185—
LMArena German1164—
LMArena Japanese1126—
LMArena Korean1104—
LMArena Spanish1153—

Instruction Following Granite 4.2 30b leads

Deepseek Coder v2: 61.7 (#242), Granite 4.2 30b: 71.2 (#155)

Instruction Following benchmarks
BenchmarkDeepseek Coder v2Granite 4.2 30b
LMArena Instruction Following11801347

Long Context Granite 4.2 30b leads

Deepseek Coder v2: 37.0 (#224), Granite 4.2 30b: 41.4 (#140)

Long Context benchmarks
BenchmarkDeepseek Coder v2Granite 4.2 30b
LMArena Longer Query12191359

Writing & Preference Granite 4.2 30b leads

Deepseek Coder v2: 38.2 (#253), Granite 4.2 30b: 53.8 (#156)

Writing & Preference benchmarks
BenchmarkDeepseek Coder v2Granite 4.2 30b
LMArena Text11911361
LMArena Creative Writing11201288
LMArena Multi-Turn11771339

Frequently asked questions

Is Deepseek Coder v2 better than Granite 4.2 30b?

Granite 4.2 30b is the stronger model overall, scoring 41.8 to 35.9 on the Noometry Index.

Is Deepseek Coder v2 or Granite 4.2 30b better for coding?

Granite 4.2 30b scores higher on coding benchmarks: 41.0 versus 38.1 in the Noometry coding category.

How many benchmarks do Deepseek Coder v2 and Granite 4.2 30b share?

11 benchmarks have published results for both models. Deepseek Coder v2 has 24 scored results on Noometry and Granite 4.2 30b has 11.

Related comparisons

Go deeper