Model comparison

MiniMax-M2.5 vs Yi-Lightning

MiniMax-M2.5 is the stronger model overall, scoring 38.3 to 37.1 on the Noometry Index.

Last verified . 17 shared benchmarks.

MiniMax-M2.5 MiniMax

38.3

Rank #188 Confirmed

Yi-Lightning 01.AI

37.1

Rank #209 Confirmed

Summary

  • They share 17 benchmarks with published results for both. MiniMax-M2.5 scores higher in 5 categories and Yi-Lightning in 3 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in coding, where MiniMax-M2.5 leads 48.1 to 27.4.
  • MiniMax-M2.5 has downloadable open weights; the other is API-only.

Side by side

MiniMax-M2.5 and Yi-Lightning specifications
MiniMax-M2.5Yi-Lightning
ProviderMiniMax01.AI
Noometry Index38.337.1
Released2026-02-122024-12-02
WeightsOpenProprietary
Context window205K—
Max output131K—
Input $ / M tokens$0.30—
Output $ / M tokens$1.20—
Results tracked3318

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding MiniMax-M2.5 leads

MiniMax-M2.5: 48.1 (#58), Yi-Lightning: 27.4 (#320)

Coding benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
LMArena Coding13811312
SWE-bench Verified (bash only)75.8%—
Aider Polyglot—12.9%
LMArena WebDev1387—
SWE-bench Multilingual68.3%—
ALE-Bench618.17—

Agentic & Tool Use Not comparable

MiniMax-M2.5: 30.4 (#77), Yi-Lightning: —

Agentic & Tool Use benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
Terminal-Bench42.7%—
Vending-Bench 2-23.16—

Reasoning Yi-Lightning leads

MiniMax-M2.5: 17.5 (#292), Yi-Lightning: 25.9 (#139)

Reasoning benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
LMArena Hard Prompts13721302
ARC-AGI-24.9%—
Kagi LLM Benchmark55.2%—
NYT Connections (extended)16.8%—
ARC-AGI-163.7%—
Epoch Capabilities Index146.68—

Math Yi-Lightning leads

MiniMax-M2.5: 26.9 (#253), Yi-Lightning: 36.2 (#172)

Math benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
LMArena Math13781300
ProofBench4%—

Knowledge MiniMax-M2.5 leads

MiniMax-M2.5: 39.2 (#135), Yi-Lightning: 35.4 (#185)

Knowledge benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
LMArena Expert13791286
Vectara Hallucination Rate9.1%—

Multilingual MiniMax-M2.5 leads

MiniMax-M2.5: 47.1 (#152), Yi-Lightning: 42.2 (#196)

Multilingual benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
LMArena Non-English13381269
LMArena Chinese13931320
LMArena French13621305
LMArena German13621267
LMArena Japanese11711228
LMArena Korean12321192
LMArena Russian13581255
LMArena Spanish13541315

Instruction Following MiniMax-M2.5 leads

MiniMax-M2.5: 71.5 (#148), Yi-Lightning: 67.4 (#196)

Instruction Following benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
LMArena Instruction Following13531278

Long Context Yi-Lightning leads

MiniMax-M2.5: 37.5 (#216), Yi-Lightning: 39.4 (#181)

Long Context benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
LMArena Longer Query13661297
CL-bench11.4%—
CL-bench Life6.3%—

Writing & Preference MiniMax-M2.5 leads

MiniMax-M2.5: 53.9 (#153), Yi-Lightning: 50.2 (#184)

Writing & Preference benchmarks
BenchmarkMiniMax-M2.5Yi-Lightning
LMArena Text13591302
LMArena Creative Writing13311280
LMArena Multi-Turn13641311
EQ-Bench Creative Writing1361—

Frequently asked questions

Is MiniMax-M2.5 better than Yi-Lightning?

MiniMax-M2.5 is the stronger model overall, scoring 38.3 to 37.1 on the Noometry Index.

Is MiniMax-M2.5 or Yi-Lightning better for coding?

MiniMax-M2.5 scores higher on coding benchmarks: 48.1 versus 27.4 in the Noometry coding category.

How many benchmarks do MiniMax-M2.5 and Yi-Lightning share?

17 benchmarks have published results for both models. MiniMax-M2.5 has 33 scored results on Noometry and Yi-Lightning has 18.

Related comparisons

Go deeper