Model comparison

Magistral Medium vs Qwen Plus

Qwen Plus is the stronger model overall, scoring 37.1 to 35.2 on the Noometry Index.

Last verified . 14 shared benchmarks.

Magistral Medium Mistral AI

35.2

Rank #227 Confirmed

Qwen Plus Alibaba (Qwen)

37.1

Rank #210 Confirmed

Summary

  • They share 14 benchmarks with published results for both. Magistral Medium scores higher in 3 categories and Qwen Plus in 5 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Qwen Plus leads 28.4 to 8.6.
  • The biggest single-benchmark swing is Kagi LLM Benchmark: 16.2% for Magistral Medium and 63.3% for Qwen Plus.
  • Qwen Plus is cheaper at $0.40 / $1.20 per million input/output tokens, against $2 / $5 for Magistral Medium.
  • Qwen Plus accepts more context: 1M tokens versus 262K.
  • Magistral Medium has downloadable open weights; the other is API-only.

Side by side

Magistral Medium and Qwen Plus specifications
Magistral MediumQwen Plus
ProviderMistral AIAlibaba (Qwen)
Noometry Index35.237.1
Released2025-03-172024-01-25
WeightsOpenProprietary
Context window262K1M
Max output16K33K
Input $ / M tokens$2$0.40
Output $ / M tokens$5$1.20
Results tracked2220

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Magistral Medium: 39.1 (#161), Qwen Plus: 38.9 (#167)

Coding benchmarks
BenchmarkMagistral MediumQwen Plus
LMArena Coding13191328
SciCode39.2%—

Reasoning Qwen Plus leads

Magistral Medium: 8.6 (#348), Qwen Plus: 28.4 (#107)

Reasoning benchmarks
BenchmarkMagistral MediumQwen Plus
Kagi LLM Benchmark16.2%63.3%
LMArena Hard Prompts12671317
ARC-AGI-20%—
ARC-AGI-16.1%—
CritPt0.3%—
DTBench—81.1%
LMCA—24%

Math Magistral Medium leads

Magistral Medium: 35.1 (#189), Qwen Plus: 23.3 (#271)

Math benchmarks
BenchmarkMagistral MediumQwen Plus
LMArena Math12501326
OTIS Mock AIME 2024-2025—17.8%
MATH Level 5—65.3%
FrontierMath (Feb 2025 set)—1.7%

Knowledge Magistral Medium leads

Magistral Medium: 33.5 (#202), Qwen Plus: 27.4 (#251)

Knowledge benchmarks
BenchmarkMagistral MediumQwen Plus
LMArena Expert12231328
GPQA Diamond—48.1%

Multilingual Qwen Plus leads

Magistral Medium: 39.6 (#224), Qwen Plus: 45.1 (#175)

Multilingual benchmarks
BenchmarkMagistral MediumQwen Plus
LMArena Non-English12321310
LMArena Chinese12271347
LMArena Japanese11751251
LMArena Russian12241323
LMArena French1267—
LMArena German1248—
LMArena Korean1125—
LMArena Spanish1271—

Instruction Following Qwen Plus leads

Magistral Medium: 66.0 (#211), Qwen Plus: 68.8 (#181)

Instruction Following benchmarks
BenchmarkMagistral MediumQwen Plus
LMArena Instruction Following12541303

Long Context Too close to call

Magistral Medium: 39.3 (#183), Qwen Plus: 40.3 (#158)

Long Context benchmarks
BenchmarkMagistral MediumQwen Plus
LMArena Longer Query12951324

Writing & Preference Qwen Plus leads

Magistral Medium: 46.3 (#219), Qwen Plus: 52.2 (#176)

Writing & Preference benchmarks
BenchmarkMagistral MediumQwen Plus
LMArena Text12551326
LMArena Creative Writing12451293
LMArena Multi-Turn12751336

Frequently asked questions

Is Magistral Medium better than Qwen Plus?

Qwen Plus is the stronger model overall, scoring 37.1 to 35.2 on the Noometry Index.

Which is cheaper, Magistral Medium or Qwen Plus?

Qwen Plus is cheaper. It lists at $0.40 per million input tokens and $1.20 per million output tokens; Magistral Medium lists at $2 and $5.

Is Magistral Medium or Qwen Plus better for coding?

They score almost the same on coding (39.1 vs 38.9); test both on your own repository before choosing.

Which has the bigger context window?

Qwen Plus does, with 1M tokens against 262K.

How many benchmarks do Magistral Medium and Qwen Plus share?

14 benchmarks have published results for both models. Magistral Medium has 22 scored results on Noometry and Qwen Plus has 20.

Related comparisons

Go deeper