Model comparison

DBRX vs Qwen1.5 4b Chat

DBRX and Qwen1.5 4b Chat score almost the same on the Noometry Index (29.4 vs 28.8), so choose on price, context window or the category you care about most.

Last verified . 13 shared benchmarks.

DBRX Databricks

29.4

Rank #311 Confirmed

Qwen1.5 4b Chat Alibaba (Qwen)

28.8

Rank #322 Confirmed

Summary

  • They share 13 benchmarks with published results for both. DBRX scores higher in 6 categories and Qwen1.5 4b Chat in 2 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Qwen1.5 4b Chat leads 26.7 to 14.9.

Side by side

DBRX and Qwen1.5 4b Chat specifications
DBRXQwen1.5 4b Chat
ProviderDatabricksAlibaba (Qwen)
Noometry Index29.428.8
Released2024-03-27—
WeightsOpenOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2113

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding DBRX leads

DBRX: 32.9 (#266), Qwen1.5 4b Chat: 29.1 (#308)

Coding benchmarks
BenchmarkDBRXQwen1.5 4b Chat
LMArena Coding1132999
HumanEval+70.1%—
MBPP+55.8%—

Reasoning DBRX leads

DBRX: 21.4 (#222), Qwen1.5 4b Chat: 18.5 (#279)

Reasoning benchmarks
BenchmarkDBRXQwen1.5 4b Chat
LMArena Hard Prompts1113976

Math Qwen1.5 4b Chat leads

DBRX: 24.3 (#269), Qwen1.5 4b Chat: 30.4 (#234)

Math benchmarks
BenchmarkDBRXQwen1.5 4b Chat
LMArena Math11451026
MATH Level 511.7%—

Knowledge Qwen1.5 4b Chat leads

DBRX: 14.9 (#294), Qwen1.5 4b Chat: 26.7 (#255)

Knowledge benchmarks
BenchmarkDBRXQwen1.5 4b Chat
LMArena Expert1076980
GPQA Diamond32.9%—

Multilingual DBRX leads

DBRX: 29.3 (#268), Qwen1.5 4b Chat: 24.1 (#290)

Multilingual benchmarks
BenchmarkDBRXQwen1.5 4b Chat
LMArena Non-English1071979
LMArena Chinese10681024
LMArena German1057902
LMArena Russian1078952
LMArena French1096—
LMArena Japanese990—
LMArena Korean993—
LMArena Spanish1064—

Instruction Following DBRX leads

DBRX: 57.5 (#270), Qwen1.5 4b Chat: 49.0 (#300)

Instruction Following benchmarks
BenchmarkDBRXQwen1.5 4b Chat
LMArena Instruction Following1112978

Long Context DBRX leads

DBRX: 33.7 (#258), Qwen1.5 4b Chat: 30.1 (#290)

Long Context benchmarks
BenchmarkDBRXQwen1.5 4b Chat
LMArena Longer Query1112988

Writing & Preference DBRX leads

DBRX: 33.6 (#275), Qwen1.5 4b Chat: 23.8 (#309)

Writing & Preference benchmarks
BenchmarkDBRXQwen1.5 4b Chat
LMArena Text1119997
LMArena Creative Writing1104969
LMArena Multi-Turn1111977

Frequently asked questions

Is DBRX better than Qwen1.5 4b Chat?

DBRX and Qwen1.5 4b Chat score almost the same on the Noometry Index (29.4 vs 28.8), so choose on price, context window or the category you care about most.

Is DBRX or Qwen1.5 4b Chat better for coding?

DBRX scores higher on coding benchmarks: 32.9 versus 29.1 in the Noometry coding category.

How many benchmarks do DBRX and Qwen1.5 4b Chat share?

13 benchmarks have published results for both models. DBRX has 21 scored results on Noometry and Qwen1.5 4b Chat has 13.

Related comparisons

Go deeper