Model comparison

Longcat Flash Chat vs MiniMax-M2.1

Longcat Flash Chat is the stronger model overall, scoring 42.1 to 38.9 on the Noometry Index.

Last verified . 18 shared benchmarks.

Longcat Flash Chat Meituan

42.1

Rank #120 Confirmed

MiniMax-M2.1 MiniMax

38.9

Rank #178 Confirmed

Summary

  • They share 18 benchmarks with published results for both. Longcat Flash Chat scores higher in 8 categories and MiniMax-M2.1 in 0 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in coding, where Longcat Flash Chat leads 43.5 to 40.4.
  • The biggest single-benchmark swing is NYT Connections (extended): 17.7% for Longcat Flash Chat and 11.2% for MiniMax-M2.1.

Side by side

Longcat Flash Chat and MiniMax-M2.1 specifications
Longcat Flash ChatMiniMax-M2.1
ProviderMeituanMiniMax
Noometry Index42.138.9
Released—2025-12-23
WeightsOpenOpen
Context window—205K
Max output—131K
Input $ / M tokens—$0.30
Output $ / M tokens—$1.20
Results tracked1922

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Longcat Flash Chat leads

Longcat Flash Chat: 43.5 (#87), MiniMax-M2.1: 40.4 (#143)

Coding benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
LMArena Coding14711421
LMArena WebDev—1384
ALE-Bench—623.83

Agentic & Tool Use Not comparable

Longcat Flash Chat: —, MiniMax-M2.1: 27.9 (#98)

Agentic & Tool Use benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
Terminal-Bench—36.6%

Reasoning Longcat Flash Chat leads

Longcat Flash Chat: 19.0 (#272), MiniMax-M2.1: 16.6 (#302)

Reasoning benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
NYT Connections (extended)17.7%11.2%
LMArena Hard Prompts14401411
Kagi LLM Benchmark43.9%—

Math Longcat Flash Chat leads

Longcat Flash Chat: 39.4 (#107), MiniMax-M2.1: 38.3 (#138)

Math benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
LMArena Math14421397

Knowledge Longcat Flash Chat leads

Longcat Flash Chat: 40.6 (#116), MiniMax-M2.1: 38.3 (#147)

Knowledge benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
LMArena Expert14541431
Vectara Hallucination Rate—11.8%

Multilingual Longcat Flash Chat leads

Longcat Flash Chat: 51.9 (#101), MiniMax-M2.1: 50.0 (#128)

Multilingual benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
LMArena Non-English14041378
LMArena Chinese14651430
LMArena French14561404
LMArena German14081381
LMArena Japanese13731287
LMArena Korean13711298
LMArena Russian13951387
LMArena Spanish14451397

Instruction Following Too close to call

Longcat Flash Chat: 74.4 (#96), MiniMax-M2.1: 73.8 (#112)

Instruction Following benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
LMArena Instruction Following14111400

Long Context Too close to call

Longcat Flash Chat: 43.5 (#93), MiniMax-M2.1: 43.2 (#101)

Long Context benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
LMArena Longer Query14251416

Writing & Preference Longcat Flash Chat leads

Longcat Flash Chat: 61.0 (#91), MiniMax-M2.1: 58.3 (#120)

Writing & Preference benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2.1
LMArena Text14271392
LMArena Creative Writing13881361
LMArena Multi-Turn14181396

Frequently asked questions

Is Longcat Flash Chat better than MiniMax-M2.1?

Longcat Flash Chat is the stronger model overall, scoring 42.1 to 38.9 on the Noometry Index.

Is Longcat Flash Chat or MiniMax-M2.1 better for coding?

Longcat Flash Chat scores higher on coding benchmarks: 43.5 versus 40.4 in the Noometry coding category.

How many benchmarks do Longcat Flash Chat and MiniMax-M2.1 share?

18 benchmarks have published results for both models. Longcat Flash Chat has 19 scored results on Noometry and MiniMax-M2.1 has 22.

Related comparisons

Go deeper