Model comparison

Magistral Medium vs Mistral Medium 3.1

Magistral Medium is the stronger model overall, scoring 35.2 to 31.9 on the Noometry Index. Mistral Medium 3.1 costs 3.4× less per token, which makes it the better buy when Magistral Medium's lead doesn't matter for your workload.

Last verified . 0 shared benchmarks.

Magistral Medium Mistral AI

35.2

Rank #227 Confirmed

Mistral Medium 3.1 Mistral AI

31.9

Rank #266 Reported

Summary

  • The widest gap is in writing & preference, where Mistral Medium 3.1 leads 55.5 to 46.3.
  • Mistral Medium 3.1 is cheaper at $0.40 / $2 per million input/output tokens, against $2 / $5 for Magistral Medium.
  • Magistral Medium accepts more context: 262K tokens versus 131K.
  • Magistral Medium has downloadable open weights; the other is API-only.

Side by side

Magistral Medium and Mistral Medium 3.1 specifications
Magistral MediumMistral Medium 3.1
ProviderMistral AIMistral AI
Noometry Index35.231.9
Released2025-03-17—
WeightsOpenProprietary
Context window262K131K
Max output16K105K
Input $ / M tokens$2$0.40
Output $ / M tokens$5$2
Results tracked223

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

Magistral Medium: 39.1 (#161), Mistral Medium 3.1: —

Coding benchmarks
BenchmarkMagistral MediumMistral Medium 3.1
SciCode39.2%—
LMArena Coding1319—

Reasoning Mistral Medium 3.1 leads

Magistral Medium: 8.6 (#348), Mistral Medium 3.1: 10.6 (#341)

Reasoning benchmarks
BenchmarkMagistral MediumMistral Medium 3.1
ARC-AGI-20%—
Kagi LLM Benchmark16.2%—
NYT Connections (extended)—6.5%
ARC-AGI-16.1%—
CritPt0.3%—
Thematic Generalization—20.3%
LMArena Hard Prompts1267—

Math Not comparable

Magistral Medium: 35.1 (#189), Mistral Medium 3.1: —

Math benchmarks
BenchmarkMagistral MediumMistral Medium 3.1
LMArena Math1250—

Knowledge Not comparable

Magistral Medium: 33.5 (#202), Mistral Medium 3.1: —

Knowledge benchmarks
BenchmarkMagistral MediumMistral Medium 3.1
LMArena Expert1223—

Multilingual Not comparable

Magistral Medium: 39.6 (#224), Mistral Medium 3.1: —

Multilingual benchmarks
BenchmarkMagistral MediumMistral Medium 3.1
LMArena Non-English1232—
LMArena Chinese1227—
LMArena French1267—
LMArena German1248—
LMArena Japanese1175—
LMArena Korean1125—
LMArena Russian1224—
LMArena Spanish1271—

Instruction Following Not comparable

Magistral Medium: 66.0 (#211), Mistral Medium 3.1: —

Instruction Following benchmarks
BenchmarkMagistral MediumMistral Medium 3.1
LMArena Instruction Following1254—

Long Context Not comparable

Magistral Medium: 39.3 (#183), Mistral Medium 3.1: —

Long Context benchmarks
BenchmarkMagistral MediumMistral Medium 3.1
LMArena Longer Query1295—

Writing & Preference Mistral Medium 3.1 leads

Magistral Medium: 46.3 (#219), Mistral Medium 3.1: 55.5 (#145)

Writing & Preference benchmarks
BenchmarkMagistral MediumMistral Medium 3.1
LMArena Text1255—
LMArena Creative Writing1245—
EQ-Bench Creative Writing—1476
LMArena Multi-Turn1275—

Frequently asked questions

Is Magistral Medium better than Mistral Medium 3.1?

Magistral Medium is the stronger model overall, scoring 35.2 to 31.9 on the Noometry Index. Mistral Medium 3.1 costs 3.4× less per token, which makes it the better buy when Magistral Medium's lead doesn't matter for your workload.

Which is cheaper, Magistral Medium or Mistral Medium 3.1?

Mistral Medium 3.1 is cheaper. It lists at $0.40 per million input tokens and $2 per million output tokens; Magistral Medium lists at $2 and $5.

Which has the bigger context window?

Magistral Medium does, with 262K tokens against 131K.

How many benchmarks do Magistral Medium and Mistral Medium 3.1 share?

0 benchmarks have published results for both models. Magistral Medium has 22 scored results on Noometry and Mistral Medium 3.1 has 3.

Related comparisons

Go deeper