Model comparison

Mistral Small vs Muse Glimmer

Muse Glimmer is the stronger model overall, scoring 41.7 to 33.4 on the Noometry Index.

Last verified . 14 shared benchmarks.

Mistral Small Mistral AI

33.4

Rank #243 Confirmed

Muse Glimmer Meta

41.7

Rank #131 Confirmed

Summary

  • They share 14 benchmarks with published results for both. Mistral Small scores higher in 0 categories and Muse Glimmer in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Muse Glimmer leads 38.8 to 16.4.
  • The biggest single-benchmark swing is SciCode: 26.5% for Mistral Small and 44.9% for Muse Glimmer.

Side by side

Mistral Small and Muse Glimmer specifications
Mistral SmallMuse Glimmer
ProviderMistral AIMeta
Noometry Index33.441.7
Released2024-02-262026-08-10
WeightsOpenOpen
Context window262K—
Max output256K—
Input $ / M tokens$0.15—
Output $ / M tokens$0.60—
Results tracked3915

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Muse Glimmer leads

Mistral Small: 34.0 (#247), Muse Glimmer: 40.4 (#142)

Coding benchmarks
BenchmarkMistral SmallMuse Glimmer
SciCode26.5%44.9%
LMArena Coding13621416
LMArena WebDev—1355
BigCodeBench Instruct36.1%—
LiveBench Coding36.2%—
BigCodeBench Complete46.6%—
ALE-Bench497.62—

Agentic & Tool Use Not comparable

Mistral Small: 28.1 (#93), Muse Glimmer: —

Agentic & Tool Use benchmarks
BenchmarkMistral SmallMuse Glimmer
Berkeley Function Calling Leaderboard37.1%—

Reasoning Muse Glimmer leads

Mistral Small: 19.8 (#250), Muse Glimmer: 25.7 (#144)

Reasoning benchmarks
BenchmarkMistral SmallMuse Glimmer
CritPt0%2.6%
LMArena Hard Prompts13351396
Kagi LLM Benchmark37.8%—
LiveBench Reasoning44.8%—
DTBench70.9%—
LiveBench Data Analysis53.7%—
LMCA20.6%—
LiveBench44%—

Math Muse Glimmer leads

Mistral Small: 16.4 (#293), Muse Glimmer: 38.8 (#125)

Math benchmarks
BenchmarkMistral SmallMuse Glimmer
LMArena Math13411417
OTIS Mock AIME 2024-20255.8%—
LiveBench Math39.9%—
MATH Level 546.8%—

Knowledge Muse Glimmer leads

Mistral Small: 31.0 (#222), Muse Glimmer: 38.5 (#143)

Knowledge benchmarks
BenchmarkMistral SmallMuse Glimmer
LMArena Expert12911386
GPQA Diamond47.5%—
Vectara Hallucination Rate5.1%—
MMLU68.7%—

Multimodal Not comparable

Mistral Small: 33.5 (#96), Muse Glimmer: —

Multimodal benchmarks
BenchmarkMistral SmallMuse Glimmer
LMArena Vision1142—

Multilingual Muse Glimmer leads

Mistral Small: 45.5 (#169), Muse Glimmer: 50.5 (#122)

Multilingual benchmarks
BenchmarkMistral SmallMuse Glimmer
LMArena Non-English13151384
LMArena Chinese13401412
LMArena Russian13241390
LMArena French1337—
LMArena German1340—
LMArena Japanese1275—
LMArena Korean1259—
LMArena Spanish1346—

Instruction Following Muse Glimmer leads

Mistral Small: 66.4 (#209), Muse Glimmer: 72.6 (#135)

Instruction Following benchmarks
BenchmarkMistral SmallMuse Glimmer
LMArena Instruction Following13101375
LiveBench Instruction Following63.7%—

Long Context Muse Glimmer leads

Mistral Small: 40.4 (#156), Muse Glimmer: 42.1 (#129)

Long Context benchmarks
BenchmarkMistral SmallMuse Glimmer
LMArena Longer Query13271382

Writing & Preference Muse Glimmer leads

Mistral Small: 52.5 (#171), Muse Glimmer: 57.5 (#126)

Writing & Preference benchmarks
BenchmarkMistral SmallMuse Glimmer
LMArena Text13381389
LMArena Creative Writing13051339
LMArena Multi-Turn13441399
LiveBench Language30.5%—

Frequently asked questions

Is Mistral Small better than Muse Glimmer?

Muse Glimmer is the stronger model overall, scoring 41.7 to 33.4 on the Noometry Index.

Is Mistral Small or Muse Glimmer better for coding?

Muse Glimmer scores higher on coding benchmarks: 40.4 versus 34.0 in the Noometry coding category.

How many benchmarks do Mistral Small and Muse Glimmer share?

14 benchmarks have published results for both models. Mistral Small has 39 scored results on Noometry and Muse Glimmer has 15.

Related comparisons

Go deeper