Model comparison

MiMo-V2.6-Pro vs Muse Spark 1.2

MiMo-V2.6-Pro and Muse Spark 1.2 score almost the same on the Noometry Index (50.3 vs 50.3), so choose on price, context window or the category you care about most.

Last verified . 18 shared benchmarks.

MiMo-V2.6-Pro Xiaomi

50.3

Rank #49 Confirmed

Muse Spark 1.2 Meta

50.3

Rank #48 Confirmed

Summary

  • They share 18 benchmarks with published results for both. MiMo-V2.6-Pro scores higher in 5 categories and Muse Spark 1.2 in 5 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Muse Spark 1.2 leads 54.1 to 43.5.
  • The biggest single-benchmark swing is ProofBench: 70% for MiMo-V2.6-Pro and 43% for Muse Spark 1.2.
  • MiMo-V2.6-Pro is cheaper at $0.43 / $0.87 per million input/output tokens, against $1.25 / $4.25 for Muse Spark 1.2.
  • MiMo-V2.6-Pro has downloadable open weights; the other is API-only.

Side by side

MiMo-V2.6-Pro and Muse Spark 1.2 specifications
MiMo-V2.6-ProMuse Spark 1.2
ProviderXiaomiMeta
Noometry Index50.350.3
Released2026-09-212026-08-05
WeightsOpenProprietary
Context window1.05M1.05M
Max output131K131K
Input $ / M tokens$0.43$1.25
Output $ / M tokens$0.87$4.25
Results tracked1931

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding MiMo-V2.6-Pro leads

MiMo-V2.6-Pro: 55.5 (#23), Muse Spark 1.2: 49.2 (#51)

Coding benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
LMArena WebDev16291533
SciCode60.9%56.4%
LMArena Coding15341495
DeepSWE—54.9%
FrontierSWE—12%
WeirdML—60.3%
ALE-Bench1,158—

Agentic & Tool Use MiMo-V2.6-Pro leads

MiMo-V2.6-Pro: 37.5 (#35), Muse Spark 1.2: 29.4 (#87)

Agentic & Tool Use benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
APEX-Agents59.5%36.4%
GDP.pdf—16%

Reasoning Muse Spark 1.2 leads

MiMo-V2.6-Pro: 43.1 (#50), Muse Spark 1.2: 51.3 (#34)

Reasoning benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
CritPt26.6%17.7%
LMArena Hard Prompts15121486
SimpleBench—74.5%
NYT Connections (extended)—79.2%
DTBench—94.7%
LMCA—48.4%
Epoch Capabilities Index—154.87

Math MiMo-V2.6-Pro leads

MiMo-V2.6-Pro: 54.5 (#45), Muse Spark 1.2: 46.4 (#70)

Math benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
ProofBench70%43%
LMArena Math14941471

Knowledge Muse Spark 1.2 leads

MiMo-V2.6-Pro: 43.5 (#92), Muse Spark 1.2: 54.1 (#53)

Knowledge benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
LMArena Expert15431480
SimpleQA Verified—60.3%

Multimodal Muse Spark 1.2 leads

MiMo-V2.6-Pro: 40.8 (#43), Muse Spark 1.2: 43.4 (#25)

Multimodal benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
LMArena Vision12641305

Multilingual Too close to call

MiMo-V2.6-Pro: 56.9 (#14), Muse Spark 1.2: 57.1 (#11)

Multilingual benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
LMArena Non-English14741478
LMArena Chinese15291511
LMArena Russian14801487
LMArena French—1513
LMArena Spanish—1498

Instruction Following MiMo-V2.6-Pro leads

MiMo-V2.6-Pro: 78.2 (#12), Muse Spark 1.2: 76.7 (#36)

Instruction Following benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
LMArena Instruction Following14931461

Long Context Too close to call

MiMo-V2.6-Pro: 46.0 (#27), Muse Spark 1.2: 45.2 (#48)

Long Context benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
LMArena Longer Query15011475

Writing & Preference Muse Spark 1.2 leads

MiMo-V2.6-Pro: 66.8 (#33), Muse Spark 1.2: 72.3 (#14)

Writing & Preference benchmarks
BenchmarkMiMo-V2.6-ProMuse Spark 1.2
LMArena Text14921482
LMArena Creative Writing14681449
LMArena Multi-Turn14641494
EQ-Bench Creative Writing—1840

Frequently asked questions

Is MiMo-V2.6-Pro better than Muse Spark 1.2?

MiMo-V2.6-Pro and Muse Spark 1.2 score almost the same on the Noometry Index (50.3 vs 50.3), so choose on price, context window or the category you care about most.

Which is cheaper, MiMo-V2.6-Pro or Muse Spark 1.2?

MiMo-V2.6-Pro is cheaper. It lists at $0.43 per million input tokens and $0.87 per million output tokens; Muse Spark 1.2 lists at $1.25 and $4.25.

Is MiMo-V2.6-Pro or Muse Spark 1.2 better for coding?

MiMo-V2.6-Pro scores higher on coding benchmarks: 55.5 versus 49.2 in the Noometry coding category.

Which has the bigger context window?

Both accept 1.05M tokens.

How many benchmarks do MiMo-V2.6-Pro and Muse Spark 1.2 share?

18 benchmarks have published results for both models. MiMo-V2.6-Pro has 19 scored results on Noometry and Muse Spark 1.2 has 31.

Related comparisons

Go deeper