Model comparison

Magistral Small vs Muse Glimmer

Muse Glimmer is the stronger model overall, scoring 41.7 to 30.2 on the Noometry Index.

Last verified . 2 shared benchmarks.

Magistral Small Mistral AI

30.2

Rank #296 Confirmed

Muse Glimmer Meta

41.7

Rank #131 Confirmed

Summary

  • They share 2 benchmarks with published results for both. Magistral Small scores higher in 0 categories and Muse Glimmer in 4 categories; 4 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Muse Glimmer leads 25.7 to 6.8.
  • The biggest single-benchmark swing is SciCode: 35.2% for Magistral Small and 44.9% for Muse Glimmer.

Side by side

Magistral Small and Muse Glimmer specifications
Magistral SmallMuse Glimmer
ProviderMistral AIMeta
Noometry Index30.241.7
Released2025-06-102026-08-10
WeightsOpenOpen
Context window128K—
Max output40K—
Input $ / M tokens$0.50—
Output $ / M tokens$1.50—
Results tracked1015

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Muse Glimmer leads

Magistral Small: 38.4 (#176), Muse Glimmer: 40.4 (#142)

Coding benchmarks
BenchmarkMagistral SmallMuse Glimmer
SciCode35.2%44.9%
LMArena WebDev—1355
LMArena Coding—1416

Reasoning Muse Glimmer leads

Magistral Small: 6.8 (#350), Muse Glimmer: 25.7 (#144)

Reasoning benchmarks
BenchmarkMagistral SmallMuse Glimmer
CritPt0.3%2.6%
ARC-AGI-20%—
Kagi LLM Benchmark6.3%—
ARC-AGI-15%—
Chess Puzzles3%—
LMArena Hard Prompts—1396
DTBench61.3%—
Epoch Capabilities Index133.19—

Math Muse Glimmer leads

Magistral Small: 26.2 (#261), Muse Glimmer: 38.8 (#125)

Math benchmarks
BenchmarkMagistral SmallMuse Glimmer
OTIS Mock AIME 2024-202530%—
LMArena Math—1417

Knowledge Muse Glimmer leads

Magistral Small: 30.9 (#223), Muse Glimmer: 38.5 (#143)

Knowledge benchmarks
BenchmarkMagistral SmallMuse Glimmer
GPQA Diamond56.1%—
LMArena Expert—1386

Multilingual Not comparable

Magistral Small: —, Muse Glimmer: 50.5 (#122)

Multilingual benchmarks
BenchmarkMagistral SmallMuse Glimmer
LMArena Non-English—1384
LMArena Chinese—1412
LMArena Russian—1390

Instruction Following Not comparable

Magistral Small: —, Muse Glimmer: 72.6 (#135)

Instruction Following benchmarks
BenchmarkMagistral SmallMuse Glimmer
LMArena Instruction Following—1375

Long Context Not comparable

Magistral Small: —, Muse Glimmer: 42.1 (#129)

Long Context benchmarks
BenchmarkMagistral SmallMuse Glimmer
LMArena Longer Query—1382

Writing & Preference Not comparable

Magistral Small: —, Muse Glimmer: 57.5 (#126)

Writing & Preference benchmarks
BenchmarkMagistral SmallMuse Glimmer
LMArena Text—1389
LMArena Creative Writing—1339
LMArena Multi-Turn—1399

Frequently asked questions

Is Magistral Small better than Muse Glimmer?

Muse Glimmer is the stronger model overall, scoring 41.7 to 30.2 on the Noometry Index.

Is Magistral Small or Muse Glimmer better for coding?

Muse Glimmer scores higher on coding benchmarks: 40.4 versus 38.4 in the Noometry coding category.

How many benchmarks do Magistral Small and Muse Glimmer share?

2 benchmarks have published results for both models. Magistral Small has 10 scored results on Noometry and Muse Glimmer has 15.

Related comparisons

Go deeper