Model comparison

Deepseek Coder v2 vs Pixtral Large

Deepseek Coder v2 is the stronger model overall, scoring 35.9 to 32.2 on the Noometry Index.

Last verified . 0 shared benchmarks.

Deepseek Coder v2 DeepSeek

35.9

Rank #220 Confirmed

Pixtral Large Mistral AI

32.2

Rank #259 Reported

Summary

  • The widest gap is in writing & preference, where Deepseek Coder v2 leads 38.2 to 32.9.

Side by side

Deepseek Coder v2 and Pixtral Large specifications
Deepseek Coder v2Pixtral Large
ProviderDeepSeekMistral AI
Noometry Index35.932.2
Released2024-06-172024-11-01
WeightsOpenOpen
Context window—128K
Max output—128K
Input $ / M tokens—$2
Output $ / M tokens—$6
Results tracked243

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

Deepseek Coder v2: 38.1 (#183), Pixtral Large: —

Coding benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
BigCodeBench Instruct48.2%—
LMArena Coding1251—
BigCodeBench Complete59.7%—
HumanEval+82.3%—
MBPP+75.1%—

Reasoning Deepseek Coder v2 leads

Deepseek Coder v2: 23.6 (#176), Pixtral Large: 21.7 (#218)

Reasoning benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
EnigmaEval—0.8%
LMArena Hard Prompts1207—
WinoGrande83.7%—

Math Not comparable

Deepseek Coder v2: 34.9 (#190), Pixtral Large: —

Math benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
LMArena Math1241—
GSM8K94.5%—

Knowledge Not comparable

Deepseek Coder v2: 32.3 (#212), Pixtral Large: —

Knowledge benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
LMArena Expert1181—
ARC (AI2) Challenge64.3%—

Multimodal Not comparable

Deepseek Coder v2: —, Pixtral Large: 30.6 (#111)

Multimodal benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
LMArena Vision—1089

Multilingual Not comparable

Deepseek Coder v2: 36.3 (#240), Pixtral Large: —

Multilingual benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
LMArena Non-English1182—
LMArena Chinese1201—
LMArena French1185—
LMArena German1164—
LMArena Japanese1126—
LMArena Korean1104—
LMArena Russian1188—
LMArena Spanish1153—

Instruction Following Not comparable

Deepseek Coder v2: 61.7 (#242), Pixtral Large: —

Instruction Following benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
LMArena Instruction Following1180—

Long Context Not comparable

Deepseek Coder v2: 37.0 (#224), Pixtral Large: —

Long Context benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
LMArena Longer Query1219—

Writing & Preference Deepseek Coder v2 leads

Deepseek Coder v2: 38.2 (#253), Pixtral Large: 32.9 (#278)

Writing & Preference benchmarks
BenchmarkDeepseek Coder v2Pixtral Large
LMArena Text1191—
LMArena Creative Writing1120—
EQ-Bench Creative Writing—988
LMArena Multi-Turn1177—

Frequently asked questions

Is Deepseek Coder v2 better than Pixtral Large?

Deepseek Coder v2 is the stronger model overall, scoring 35.9 to 32.2 on the Noometry Index.

How many benchmarks do Deepseek Coder v2 and Pixtral Large share?

0 benchmarks have published results for both models. Deepseek Coder v2 has 24 scored results on Noometry and Pixtral Large has 3.

Related comparisons

Go deeper