Model comparison

Magistral Medium vs Qwen Turbo

Magistral Medium is the stronger model overall, scoring 35.2 to 27.1 on the Noometry Index. Qwen Turbo costs 31× less per token, which makes it the better buy when Magistral Medium's lead doesn't matter for your workload.

Last verified . 0 shared benchmarks.

Magistral Medium Mistral AI

35.2

Rank #227 Confirmed

Qwen Turbo Alibaba (Qwen)

27.1

Rank #335 Reported

Summary

  • The widest gap is in math, where Magistral Medium leads 35.1 to 15.3.
  • Qwen Turbo is cheaper at $0.05 / $0.20 per million input/output tokens, against $2 / $5 for Magistral Medium.
  • Qwen Turbo accepts more context: 1M tokens versus 262K.
  • Magistral Medium has downloadable open weights; the other is API-only.

Side by side

Magistral Medium and Qwen Turbo specifications
Magistral MediumQwen Turbo
ProviderMistral AIAlibaba (Qwen)
Noometry Index35.227.1
Released2025-03-172024-11-01
WeightsOpenProprietary
Context window262K1M
Max output16K16K
Input $ / M tokens$2$0.05
Output $ / M tokens$5$0.20
Results tracked223

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

Magistral Medium: 39.1 (#161), Qwen Turbo: —

Coding benchmarks
BenchmarkMagistral MediumQwen Turbo
SciCode39.2%—
LMArena Coding1319—

Reasoning Not comparable

Magistral Medium: 8.6 (#348), Qwen Turbo: —

Reasoning benchmarks
BenchmarkMagistral MediumQwen Turbo
ARC-AGI-20%—
Kagi LLM Benchmark16.2%—
ARC-AGI-16.1%—
CritPt0.3%—
LMArena Hard Prompts1267—

Math Magistral Medium leads

Magistral Medium: 35.1 (#189), Qwen Turbo: 15.3 (#297)

Math benchmarks
BenchmarkMagistral MediumQwen Turbo
OTIS Mock AIME 2024-2025—6.1%
LMArena Math1250—
MATH Level 5—56.2%

Knowledge Magistral Medium leads

Magistral Medium: 33.5 (#202), Qwen Turbo: 22.2 (#272)

Knowledge benchmarks
BenchmarkMagistral MediumQwen Turbo
GPQA Diamond—41.8%
LMArena Expert1223—

Multilingual Not comparable

Magistral Medium: 39.6 (#224), Qwen Turbo: —

Multilingual benchmarks
BenchmarkMagistral MediumQwen Turbo
LMArena Non-English1232—
LMArena Chinese1227—
LMArena French1267—
LMArena German1248—
LMArena Japanese1175—
LMArena Korean1125—
LMArena Russian1224—
LMArena Spanish1271—

Instruction Following Not comparable

Magistral Medium: 66.0 (#211), Qwen Turbo: —

Instruction Following benchmarks
BenchmarkMagistral MediumQwen Turbo
LMArena Instruction Following1254—

Long Context Not comparable

Magistral Medium: 39.3 (#183), Qwen Turbo: —

Long Context benchmarks
BenchmarkMagistral MediumQwen Turbo
LMArena Longer Query1295—

Writing & Preference Not comparable

Magistral Medium: 46.3 (#219), Qwen Turbo: —

Writing & Preference benchmarks
BenchmarkMagistral MediumQwen Turbo
LMArena Text1255—
LMArena Creative Writing1245—
LMArena Multi-Turn1275—

Frequently asked questions

Is Magistral Medium better than Qwen Turbo?

Magistral Medium is the stronger model overall, scoring 35.2 to 27.1 on the Noometry Index. Qwen Turbo costs 31× less per token, which makes it the better buy when Magistral Medium's lead doesn't matter for your workload.

Which is cheaper, Magistral Medium or Qwen Turbo?

Qwen Turbo is cheaper. It lists at $0.05 per million input tokens and $0.20 per million output tokens; Magistral Medium lists at $2 and $5.

Which has the bigger context window?

Qwen Turbo does, with 1M tokens against 262K.

How many benchmarks do Magistral Medium and Qwen Turbo share?

0 benchmarks have published results for both models. Magistral Medium has 22 scored results on Noometry and Qwen Turbo has 3.

Related comparisons

Go deeper