Model comparison

Deepseek Coder v2 vs Gemma 3n E4b IT

Gemma 3n E4b IT is the stronger model overall, scoring 37.3 to 35.9 on the Noometry Index.

Last verified . 17 shared benchmarks.

Deepseek Coder v2 DeepSeek

35.9

Rank #220 Confirmed

Gemma 3n E4b IT Google

37.3

Rank #206 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Deepseek Coder v2 scores higher in 2 categories and Gemma 3n E4b IT in 6 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Gemma 3n E4b IT leads 50.1 to 38.2.

Side by side

Deepseek Coder v2 and Gemma 3n E4b IT specifications
Deepseek Coder v2Gemma 3n E4b IT
ProviderDeepSeekGoogle
Noometry Index35.937.3
Released2024-06-17—
WeightsOpenOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2418

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Deepseek Coder v2 leads

Deepseek Coder v2: 38.1 (#183), Gemma 3n E4b IT: 37.0 (#198)

Coding benchmarks
BenchmarkDeepseek Coder v2Gemma 3n E4b IT
LMArena Coding12511268
BigCodeBench Instruct48.2%—
BigCodeBench Complete59.7%—
HumanEval+82.3%—
MBPP+75.1%—

Reasoning Deepseek Coder v2 leads

Deepseek Coder v2: 23.6 (#176), Gemma 3n E4b IT: 19.9 (#247)

Reasoning benchmarks
BenchmarkDeepseek Coder v2Gemma 3n E4b IT
LMArena Hard Prompts12071284
Kagi LLM Benchmark—31.5%
WinoGrande83.7%—

Math Too close to call

Deepseek Coder v2: 34.9 (#190), Gemma 3n E4b IT: 35.1 (#188)

Math benchmarks
BenchmarkDeepseek Coder v2Gemma 3n E4b IT
LMArena Math12411251
GSM8K94.5%—

Knowledge Gemma 3n E4b IT leads

Deepseek Coder v2: 32.3 (#212), Gemma 3n E4b IT: 34.2 (#198)

Knowledge benchmarks
BenchmarkDeepseek Coder v2Gemma 3n E4b IT
LMArena Expert11811246
ARC (AI2) Challenge64.3%—

Multilingual Gemma 3n E4b IT leads

Deepseek Coder v2: 36.3 (#240), Gemma 3n E4b IT: 43.4 (#183)

Multilingual benchmarks
BenchmarkDeepseek Coder v2Gemma 3n E4b IT
LMArena Non-English11821285
LMArena Chinese12011309
LMArena French11851330
LMArena German11641311
LMArena Japanese11261272
LMArena Korean11041259
LMArena Russian11881288
LMArena Spanish11531305

Instruction Following Gemma 3n E4b IT leads

Deepseek Coder v2: 61.7 (#242), Gemma 3n E4b IT: 66.1 (#210)

Instruction Following benchmarks
BenchmarkDeepseek Coder v2Gemma 3n E4b IT
LMArena Instruction Following11801255

Long Context Gemma 3n E4b IT leads

Deepseek Coder v2: 37.0 (#224), Gemma 3n E4b IT: 38.7 (#191)

Long Context benchmarks
BenchmarkDeepseek Coder v2Gemma 3n E4b IT
LMArena Longer Query12191276

Writing & Preference Gemma 3n E4b IT leads

Deepseek Coder v2: 38.2 (#253), Gemma 3n E4b IT: 50.1 (#186)

Writing & Preference benchmarks
BenchmarkDeepseek Coder v2Gemma 3n E4b IT
LMArena Text11911306
LMArena Creative Writing11201287
LMArena Multi-Turn11771276

Frequently asked questions

Is Deepseek Coder v2 better than Gemma 3n E4b IT?

Gemma 3n E4b IT is the stronger model overall, scoring 37.3 to 35.9 on the Noometry Index.

Is Deepseek Coder v2 or Gemma 3n E4b IT better for coding?

Deepseek Coder v2 scores higher on coding benchmarks: 38.1 versus 37.0 in the Noometry coding category.

How many benchmarks do Deepseek Coder v2 and Gemma 3n E4b IT share?

17 benchmarks have published results for both models. Deepseek Coder v2 has 24 scored results on Noometry and Gemma 3n E4b IT has 18.

Related comparisons

Go deeper