Model comparison
Magistral Small vs Muse Glimmer
Muse Glimmer is the stronger model overall, scoring 41.7 to 30.2 on the Noometry Index.
Last verified . 2 shared benchmarks.
Summary
- They share 2 benchmarks with published results for both. Magistral Small scores higher in 0 categories and Muse Glimmer in 4 categories; 4 gaps are clear of the uncertainty.
- The widest gap is in reasoning, where Muse Glimmer leads 25.7 to 6.8.
- The biggest single-benchmark swing is SciCode: 35.2% for Magistral Small and 44.9% for Muse Glimmer.
Side by side
| Magistral Small | Muse Glimmer | |
|---|---|---|
| Provider | Mistral AI | Meta |
| Noometry Index | 30.2 | 41.7 |
| Released | 2025-06-10 | 2026-08-10 |
| Weights | Open | Open |
| Context window | 128K | — |
| Max output | 40K | — |
| Input $ / M tokens | $0.50 | — |
| Output $ / M tokens | $1.50 | — |
| Results tracked | 10 | 15 |
Sponsored placements are available on pages like this one. Advertise on Noometry
Category by category
Coding Muse Glimmer leads
Magistral Small: 38.4 (#176), Muse Glimmer: 40.4 (#142)
| Benchmark | Magistral Small | Muse Glimmer |
|---|---|---|
| SciCode | 35.2% | 44.9% |
| LMArena WebDev | — | 1355 |
| LMArena Coding | — | 1416 |
Reasoning Muse Glimmer leads
Magistral Small: 6.8 (#350), Muse Glimmer: 25.7 (#144)
| Benchmark | Magistral Small | Muse Glimmer |
|---|---|---|
| CritPt | 0.3% | 2.6% |
| ARC-AGI-2 | 0% | — |
| Kagi LLM Benchmark | 6.3% | — |
| ARC-AGI-1 | 5% | — |
| Chess Puzzles | 3% | — |
| LMArena Hard Prompts | — | 1396 |
| DTBench | 61.3% | — |
| Epoch Capabilities Index | 133.19 | — |
Math Muse Glimmer leads
Magistral Small: 26.2 (#261), Muse Glimmer: 38.8 (#125)
| Benchmark | Magistral Small | Muse Glimmer |
|---|---|---|
| OTIS Mock AIME 2024-2025 | 30% | — |
| LMArena Math | — | 1417 |
Knowledge Muse Glimmer leads
Magistral Small: 30.9 (#223), Muse Glimmer: 38.5 (#143)
| Benchmark | Magistral Small | Muse Glimmer |
|---|---|---|
| GPQA Diamond | 56.1% | — |
| LMArena Expert | — | 1386 |
Multilingual Not comparable
Magistral Small: —, Muse Glimmer: 50.5 (#122)
| Benchmark | Magistral Small | Muse Glimmer |
|---|---|---|
| LMArena Non-English | — | 1384 |
| LMArena Chinese | — | 1412 |
| LMArena Russian | — | 1390 |
Instruction Following Not comparable
Magistral Small: —, Muse Glimmer: 72.6 (#135)
| Benchmark | Magistral Small | Muse Glimmer |
|---|---|---|
| LMArena Instruction Following | — | 1375 |
Long Context Not comparable
Magistral Small: —, Muse Glimmer: 42.1 (#129)
| Benchmark | Magistral Small | Muse Glimmer |
|---|---|---|
| LMArena Longer Query | — | 1382 |
Writing & Preference Not comparable
Magistral Small: —, Muse Glimmer: 57.5 (#126)
| Benchmark | Magistral Small | Muse Glimmer |
|---|---|---|
| LMArena Text | — | 1389 |
| LMArena Creative Writing | — | 1339 |
| LMArena Multi-Turn | — | 1399 |
Frequently asked questions
Is Magistral Small better than Muse Glimmer?
Muse Glimmer is the stronger model overall, scoring 41.7 to 30.2 on the Noometry Index.
Is Magistral Small or Muse Glimmer better for coding?
Muse Glimmer scores higher on coding benchmarks: 40.4 versus 38.4 in the Noometry coding category.
How many benchmarks do Magistral Small and Muse Glimmer share?
2 benchmarks have published results for both models. Magistral Small has 10 scored results on Noometry and Muse Glimmer has 15.