Model comparison

Longcat Flash Chat vs MiniMax-M2

Longcat Flash Chat is the stronger model overall, scoring 42.1 to 37.4 on the Noometry Index.

Last verified . 17 shared benchmarks.

Longcat Flash Chat Meituan

42.1

Rank #120 Confirmed

MiniMax-M2 MiniMax

37.4

Rank #204 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Longcat Flash Chat scores higher in 7 categories and MiniMax-M2 in 1 category; 7 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Longcat Flash Chat leads 61.0 to 53.0.
  • The biggest single-benchmark swing is Kagi LLM Benchmark: 43.9% for Longcat Flash Chat and 57.8% for MiniMax-M2.

Side by side

Longcat Flash Chat and MiniMax-M2 specifications
Longcat Flash ChatMiniMax-M2
ProviderMeituanMiniMax
Noometry Index42.137.4
Released—2025-10-27
WeightsOpenOpen
Context window—205K
Max output—131K
Input $ / M tokens—$0.30
Output $ / M tokens—$1.20
Results tracked1921

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Longcat Flash Chat leads

Longcat Flash Chat: 43.5 (#87), MiniMax-M2: 39.3 (#159)

Coding benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
LMArena Coding14711370
SWE-bench Verified (bash only)—61%
LMArena WebDev—1297

Agentic & Tool Use Not comparable

Longcat Flash Chat: —, MiniMax-M2: 25.1 (#109)

Agentic & Tool Use benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
Terminal-Bench—30%
Vending-Bench 2—160.6

Reasoning Too close to call

Longcat Flash Chat: 19.0 (#272), MiniMax-M2: 19.4 (#258)

Reasoning benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
Kagi LLM Benchmark43.9%57.8%
NYT Connections (extended)17.7%14.8%
LMArena Hard Prompts14401357

Math Longcat Flash Chat leads

Longcat Flash Chat: 39.4 (#107), MiniMax-M2: 37.3 (#160)

Math benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
LMArena Math14421352

Knowledge Longcat Flash Chat leads

Longcat Flash Chat: 40.6 (#116), MiniMax-M2: 37.0 (#163)

Knowledge benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
LMArena Expert14541337

Multilingual Longcat Flash Chat leads

Longcat Flash Chat: 51.9 (#101), MiniMax-M2: 45.3 (#171)

Multilingual benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
LMArena Non-English14041313
LMArena Chinese14651366
LMArena French14561335
LMArena German14081355
LMArena Russian13951331
LMArena Spanish14451326
LMArena Japanese1373—
LMArena Korean1371—

Instruction Following Longcat Flash Chat leads

Longcat Flash Chat: 74.4 (#96), MiniMax-M2: 70.2 (#166)

Instruction Following benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
LMArena Instruction Following14111328

Long Context Longcat Flash Chat leads

Longcat Flash Chat: 43.5 (#93), MiniMax-M2: 40.5 (#153)

Long Context benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
LMArena Longer Query14251331

Writing & Preference Longcat Flash Chat leads

Longcat Flash Chat: 61.0 (#91), MiniMax-M2: 53.0 (#162)

Writing & Preference benchmarks
BenchmarkLongcat Flash ChatMiniMax-M2
LMArena Text14271340
LMArena Creative Writing13881286
LMArena Multi-Turn14181361

Frequently asked questions

Is Longcat Flash Chat better than MiniMax-M2?

Longcat Flash Chat is the stronger model overall, scoring 42.1 to 37.4 on the Noometry Index.

Is Longcat Flash Chat or MiniMax-M2 better for coding?

Longcat Flash Chat scores higher on coding benchmarks: 43.5 versus 39.3 in the Noometry coding category.

How many benchmarks do Longcat Flash Chat and MiniMax-M2 share?

17 benchmarks have published results for both models. Longcat Flash Chat has 19 scored results on Noometry and MiniMax-M2 has 21.

Related comparisons

Go deeper