Model comparison

Mistral Medium 3.1 vs Muse Glimmer

Muse Glimmer is the stronger model overall, scoring 41.7 to 31.9 on the Noometry Index.

Last verified . 0 shared benchmarks.

Mistral Medium 3.1 Mistral AI

31.9

Rank #266 Reported

Muse Glimmer Meta

41.7

Rank #131 Confirmed

Summary

  • The widest gap is in reasoning, where Muse Glimmer leads 25.7 to 10.6.
  • Muse Glimmer has downloadable open weights; the other is API-only.

Side by side

Mistral Medium 3.1 and Muse Glimmer specifications
Mistral Medium 3.1Muse Glimmer
ProviderMistral AIMeta
Noometry Index31.941.7
Released—2026-08-10
WeightsProprietaryOpen
Context window131K—
Max output105K—
Input $ / M tokens$0.40—
Output $ / M tokens$2—
Results tracked315

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

Mistral Medium 3.1: —, Muse Glimmer: 40.4 (#142)

Coding benchmarks
BenchmarkMistral Medium 3.1Muse Glimmer
LMArena WebDev—1355
SciCode—44.9%
LMArena Coding—1416

Reasoning Muse Glimmer leads

Mistral Medium 3.1: 10.6 (#341), Muse Glimmer: 25.7 (#144)

Reasoning benchmarks
BenchmarkMistral Medium 3.1Muse Glimmer
NYT Connections (extended)6.5%—
CritPt—2.6%
Thematic Generalization20.3%—
LMArena Hard Prompts—1396

Math Not comparable

Mistral Medium 3.1: —, Muse Glimmer: 38.8 (#125)

Math benchmarks
BenchmarkMistral Medium 3.1Muse Glimmer
LMArena Math—1417

Knowledge Not comparable

Mistral Medium 3.1: —, Muse Glimmer: 38.5 (#143)

Knowledge benchmarks
BenchmarkMistral Medium 3.1Muse Glimmer
LMArena Expert—1386

Multilingual Not comparable

Mistral Medium 3.1: —, Muse Glimmer: 50.5 (#122)

Multilingual benchmarks
BenchmarkMistral Medium 3.1Muse Glimmer
LMArena Non-English—1384
LMArena Chinese—1412
LMArena Russian—1390

Instruction Following Not comparable

Mistral Medium 3.1: —, Muse Glimmer: 72.6 (#135)

Instruction Following benchmarks
BenchmarkMistral Medium 3.1Muse Glimmer
LMArena Instruction Following—1375

Long Context Not comparable

Mistral Medium 3.1: —, Muse Glimmer: 42.1 (#129)

Long Context benchmarks
BenchmarkMistral Medium 3.1Muse Glimmer
LMArena Longer Query—1382

Writing & Preference Muse Glimmer leads

Mistral Medium 3.1: 55.5 (#145), Muse Glimmer: 57.5 (#126)

Writing & Preference benchmarks
BenchmarkMistral Medium 3.1Muse Glimmer
LMArena Text—1389
LMArena Creative Writing—1339
EQ-Bench Creative Writing1476—
LMArena Multi-Turn—1399

Frequently asked questions

Is Mistral Medium 3.1 better than Muse Glimmer?

Muse Glimmer is the stronger model overall, scoring 41.7 to 31.9 on the Noometry Index.

How many benchmarks do Mistral Medium 3.1 and Muse Glimmer share?

0 benchmarks have published results for both models. Mistral Medium 3.1 has 3 scored results on Noometry and Muse Glimmer has 15.

Related comparisons

Go deeper