Model comparison

Mistral Large 3 vs Muse Glimmer

Muse Glimmer is the stronger model overall, scoring 41.7 to 39.1 on the Noometry Index.

Last verified . 13 shared benchmarks.

Mistral Large 3 Mistral AI

39.1

Rank #176 Confirmed

Muse Glimmer Meta

41.7

Rank #131 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Mistral Large 3 scores higher in 4 categories and Muse Glimmer in 4 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Muse Glimmer leads 25.7 to 15.2.

Side by side

Mistral Large 3 and Muse Glimmer specifications
Mistral Large 3Muse Glimmer
ProviderMistral AIMeta
Noometry Index39.141.7
Released2025-12-022026-08-10
WeightsOpenOpen
Context window262K—
Max output8K—
Input $ / M tokens$0.25—
Output $ / M tokens$0.75—
Results tracked2415

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Muse Glimmer leads

Mistral Large 3: 34.4 (#237), Muse Glimmer: 40.4 (#142)

Coding benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena WebDev12301355
LMArena Coding14481416
SciCode—44.9%

Reasoning Muse Glimmer leads

Mistral Large 3: 15.2 (#319), Muse Glimmer: 25.7 (#144)

Reasoning benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena Hard Prompts14291396
Kagi LLM Benchmark50.9%—
NYT Connections (extended)7.5%—
CritPt—2.6%
Thematic Generalization23%—

Math Too close to call

Mistral Large 3: 38.7 (#129), Muse Glimmer: 38.8 (#125)

Math benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena Math14141417

Knowledge Muse Glimmer leads

Mistral Large 3: 36.0 (#177), Muse Glimmer: 38.5 (#143)

Knowledge benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena Expert14211386
Vectara Hallucination Rate14.5%—

Multimodal Not comparable

Mistral Large 3: 38.2 (#66), Muse Glimmer: —

Multimodal benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena Vision1221—

Multilingual Mistral Large 3 leads

Mistral Large 3: 52.5 (#84), Muse Glimmer: 50.5 (#122)

Multilingual benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena Non-English14131384
LMArena Chinese14471412
LMArena Russian14111390
LMArena French1455—
LMArena German1437—
LMArena Japanese1394—
LMArena Korean1384—
LMArena Spanish1440—

Instruction Following Mistral Large 3 leads

Mistral Large 3: 74.0 (#108), Muse Glimmer: 72.6 (#135)

Instruction Following benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena Instruction Following14031375

Long Context Mistral Large 3 leads

Mistral Large 3: 43.1 (#105), Muse Glimmer: 42.1 (#129)

Long Context benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena Longer Query14131382

Writing & Preference Mistral Large 3 leads

Mistral Large 3: 60.0 (#101), Muse Glimmer: 57.5 (#126)

Writing & Preference benchmarks
BenchmarkMistral Large 3Muse Glimmer
LMArena Text14281389
LMArena Creative Writing13861339
LMArena Multi-Turn14291399
EQ-Bench Creative Writing1412—

Frequently asked questions

Is Mistral Large 3 better than Muse Glimmer?

Muse Glimmer is the stronger model overall, scoring 41.7 to 39.1 on the Noometry Index.

Is Mistral Large 3 or Muse Glimmer better for coding?

Muse Glimmer scores higher on coding benchmarks: 40.4 versus 34.4 in the Noometry coding category.

How many benchmarks do Mistral Large 3 and Muse Glimmer share?

13 benchmarks have published results for both models. Mistral Large 3 has 24 scored results on Noometry and Muse Glimmer has 15.

Related comparisons

Go deeper