Model comparison

DBRX vs Mistral Large

Mistral Large is the stronger model overall, scoring 31.9 to 29.4 on the Noometry Index.

Last verified . 21 shared benchmarks.

DBRX Databricks

29.4

Rank #311 Confirmed

Mistral Large Mistral AI

31.9

Rank #263 Confirmed

Summary

  • They share 21 benchmarks with published results for both. DBRX scores higher in 2 categories and Mistral Large in 6 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Mistral Large leads 30.1 to 14.9.
  • The biggest single-benchmark swing is MATH Level 5: 11.7% for DBRX and 50.3% for Mistral Large.

Side by side

DBRX and Mistral Large specifications
DBRXMistral Large
ProviderDatabricksMistral AI
Noometry Index29.431.9
Released2024-03-272024-02-26
WeightsOpenOpen
Context window—131K
Max output—16K
Input $ / M tokens—$2
Output $ / M tokens—$6
Results tracked2151

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Mistral Large leads

DBRX: 32.9 (#266), Mistral Large: 34.3 (#240)

Coding benchmarks
BenchmarkDBRXMistral Large
LMArena Coding11321277
HumanEval+70.1%62.2%
MBPP+55.8%59.5%
SciCode—36.2%
BigCodeBench Instruct—30%
LiveBench Coding—47.1%
BigCodeBench Complete—38.3%
ALE-Bench—264.7

Agentic & Tool Use Not comparable

DBRX: —, Mistral Large: 28.6 (#89)

Agentic & Tool Use benchmarks
BenchmarkDBRXMistral Large
Berkeley Function Calling Leaderboard—38.4%

Reasoning DBRX leads

DBRX: 21.4 (#222), Mistral Large: 15.8 (#310)

Reasoning benchmarks
BenchmarkDBRXMistral Large
LMArena Hard Prompts11131257
SimpleBench—22.5%
CritPt—0%
LiveBench Reasoning—43.5%
DTBench—65.1%
LiveBench Data Analysis—50.1%
LMCA—16.7%
Epoch Capabilities Index—128.52
ForecastBench—57.1
LiveBench—48.4%

Math DBRX leads

DBRX: 24.3 (#269), Mistral Large: 18.2 (#291)

Math benchmarks
BenchmarkDBRXMistral Large
LMArena Math11451262
MATH Level 511.7%50.3%
OTIS Mock AIME 2024-2025—8.5%
Omni-MATH—28.1%
LiveBench Math—42.5%
FrontierMath (Feb 2025 set)—0.3%

Knowledge Mistral Large leads

DBRX: 14.9 (#294), Mistral Large: 30.1 (#230)

Knowledge benchmarks
BenchmarkDBRXMistral Large
GPQA Diamond32.9%51.3%
LMArena Expert10761232
MMLU-Pro—59.9%
Confabulations—21.4%
Vectara Hallucination Rate—4.5%
GPQA (HELM)—43.5%
MMLU—80%

Multilingual Mistral Large leads

DBRX: 29.3 (#268), Mistral Large: 40.0 (#219)

Multilingual benchmarks
BenchmarkDBRXMistral Large
LMArena Non-English10711237
LMArena Chinese10681240
LMArena French10961325
LMArena German10571254
LMArena Japanese9901188
LMArena Korean9931202
LMArena Russian10781257
LMArena Spanish10641268

Instruction Following Mistral Large leads

DBRX: 57.5 (#270), Mistral Large: 67.9 (#191)

Instruction Following benchmarks
BenchmarkDBRXMistral Large
LMArena Instruction Following11121249
LiveBench Instruction Following—67.9%
IFEval—87.7%

Long Context Mistral Large leads

DBRX: 33.7 (#258), Mistral Large: 38.3 (#199)

Long Context benchmarks
BenchmarkDBRXMistral Large
LMArena Longer Query11121261

Writing & Preference Mistral Large leads

DBRX: 33.6 (#275), Mistral Large: 40.7 (#242)

Writing & Preference benchmarks
BenchmarkDBRXMistral Large
LMArena Text11191266
LMArena Creative Writing11041243
LMArena Multi-Turn11111260
Short-Story Creative Writing—69%
EQ-Bench Creative Writing—985
WildBench—80.1%
LiveBench Language—39.4%

Frequently asked questions

Is DBRX better than Mistral Large?

Mistral Large is the stronger model overall, scoring 31.9 to 29.4 on the Noometry Index.

Is DBRX or Mistral Large better for coding?

Mistral Large scores higher on coding benchmarks: 34.3 versus 32.9 in the Noometry coding category.

How many benchmarks do DBRX and Mistral Large share?

21 benchmarks have published results for both models. DBRX has 21 scored results on Noometry and Mistral Large has 51.

Related comparisons

Go deeper