Model comparison

Deepseek Coder v2 vs Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite is the stronger model overall, scoring 40.8 to 35.9 on the Noometry Index.

Last verified . 17 shared benchmarks.

Deepseek Coder v2 DeepSeek

35.9

Rank #220 Confirmed

Gemini 3.1 Flash Lite Google

40.8

Rank #144 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Deepseek Coder v2 scores higher in 2 categories and Gemini 3.1 Flash Lite in 6 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Gemini 3.1 Flash Lite leads 60.9 to 38.2.
  • Deepseek Coder v2 has downloadable open weights; the other is API-only.

Side by side

Deepseek Coder v2 and Gemini 3.1 Flash Lite specifications
Deepseek Coder v2Gemini 3.1 Flash Lite
ProviderDeepSeekGoogle
Noometry Index35.940.8
Released2024-06-172026-03-03
WeightsOpenProprietary
Context window—1.05M
Max output—66K
Input $ / M tokens—$0.25
Output $ / M tokens—$1.50
Results tracked2438

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Deepseek Coder v2: 38.1 (#183), Gemini 3.1 Flash Lite: 37.8 (#188)

Coding benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Coding12511400
LMArena WebDev—1256
SciCode—41.9%
WeirdML—52.2%
BigCodeBench Instruct48.2%—
BigCodeBench Complete59.7%—
ALE-Bench—797.73
HumanEval+82.3%—
MBPP+75.1%—

Agentic & Tool Use Not comparable

Deepseek Coder v2: —, Gemini 3.1 Flash Lite: 30.2 (#79)

Agentic & Tool Use benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
DeepResearch Bench—37.3%

Reasoning Too close to call

Deepseek Coder v2: 23.6 (#176), Gemini 3.1 Flash Lite: 22.9 (#186)

Reasoning benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Hard Prompts12071407
Kagi LLM Benchmark—67.2%
NYT Connections (extended)—8.2%
CritPt—1.1%
Chess Puzzles—25%
EnigmaEval—3%
Thematic Generalization—63.3%
DTBench—76.8%
LMCA—35%
Epoch Capabilities Index—144.47
ForecastBench—54.4
WinoGrande83.7%—

Math Gemini 3.1 Flash Lite leads

Deepseek Coder v2: 34.9 (#190), Gemini 3.1 Flash Lite: 40.7 (#90)

Math benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Math12411428
FrontierMath (Tiers 1-3)—27.7%
OTIS Mock AIME 2024-2025—80%
GSM8K94.5%—

Knowledge Gemini 3.1 Flash Lite leads

Deepseek Coder v2: 32.3 (#212), Gemini 3.1 Flash Lite: 41.9 (#104)

Knowledge benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Expert11811398
GPQA Diamond—81.8%
Humanity's Last Exam—8.6%
Vectara Hallucination Rate—8.2%
ARC (AI2) Challenge64.3%—

Multimodal Not comparable

Deepseek Coder v2: —, Gemini 3.1 Flash Lite: 39.4 (#60)

Multimodal benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Vision—1240

Multilingual Gemini 3.1 Flash Lite leads

Deepseek Coder v2: 36.3 (#240), Gemini 3.1 Flash Lite: 52.3 (#86)

Multilingual benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Non-English11821411
LMArena Chinese12011461
LMArena French11851424
LMArena German11641429
LMArena Japanese11261413
LMArena Korean11041392
LMArena Russian11881420
LMArena Spanish11531421

Instruction Following Gemini 3.1 Flash Lite leads

Deepseek Coder v2: 61.7 (#242), Gemini 3.1 Flash Lite: 72.7 (#131)

Instruction Following benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Instruction Following11801377

Long Context Gemini 3.1 Flash Lite leads

Deepseek Coder v2: 37.0 (#224), Gemini 3.1 Flash Lite: 42.5 (#122)

Long Context benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Longer Query12191394

Writing & Preference Gemini 3.1 Flash Lite leads

Deepseek Coder v2: 38.2 (#253), Gemini 3.1 Flash Lite: 60.9 (#94)

Writing & Preference benchmarks
BenchmarkDeepseek Coder v2Gemini 3.1 Flash Lite
LMArena Text11911416
LMArena Creative Writing11201401
LMArena Multi-Turn11771417

Frequently asked questions

Is Deepseek Coder v2 better than Gemini 3.1 Flash Lite?

Gemini 3.1 Flash Lite is the stronger model overall, scoring 40.8 to 35.9 on the Noometry Index.

Is Deepseek Coder v2 or Gemini 3.1 Flash Lite better for coding?

They score almost the same on coding (38.1 vs 37.8); test both on your own repository before choosing.

How many benchmarks do Deepseek Coder v2 and Gemini 3.1 Flash Lite share?

17 benchmarks have published results for both models. Deepseek Coder v2 has 24 scored results on Noometry and Gemini 3.1 Flash Lite has 38.

Related comparisons

Go deeper