Model comparison

Longcat Flash Chat vs Magistral Medium

Longcat Flash Chat is the stronger model overall, scoring 42.1 to 35.2 on the Noometry Index.

Last verified . 18 shared benchmarks.

Longcat Flash Chat Meituan

42.1

Rank #120 Confirmed

Magistral Medium Mistral AI

35.2

Rank #227 Confirmed

Summary

  • They share 18 benchmarks with published results for both. Longcat Flash Chat scores higher in 8 categories and Magistral Medium in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Longcat Flash Chat leads 61.0 to 46.3.
  • The biggest single-benchmark swing is Kagi LLM Benchmark: 43.9% for Longcat Flash Chat and 16.2% for Magistral Medium.

Side by side

Longcat Flash Chat and Magistral Medium specifications
Longcat Flash ChatMagistral Medium
ProviderMeituanMistral AI
Noometry Index42.135.2
Released—2025-03-17
WeightsOpenOpen
Context window—262K
Max output—16K
Input $ / M tokens—$2
Output $ / M tokens—$5
Results tracked1922

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Longcat Flash Chat leads

Longcat Flash Chat: 43.5 (#87), Magistral Medium: 39.1 (#161)

Coding benchmarks
BenchmarkLongcat Flash ChatMagistral Medium
LMArena Coding14711319
SciCode—39.2%

Reasoning Longcat Flash Chat leads

Longcat Flash Chat: 19.0 (#272), Magistral Medium: 8.6 (#348)

Reasoning benchmarks
BenchmarkLongcat Flash ChatMagistral Medium
Kagi LLM Benchmark43.9%16.2%
LMArena Hard Prompts14401267
ARC-AGI-2—0%
NYT Connections (extended)17.7%—
ARC-AGI-1—6.1%
CritPt—0.3%

Math Longcat Flash Chat leads

Longcat Flash Chat: 39.4 (#107), Magistral Medium: 35.1 (#189)

Math benchmarks
BenchmarkLongcat Flash ChatMagistral Medium
LMArena Math14421250

Knowledge Longcat Flash Chat leads

Longcat Flash Chat: 40.6 (#116), Magistral Medium: 33.5 (#202)

Knowledge benchmarks
BenchmarkLongcat Flash ChatMagistral Medium
LMArena Expert14541223

Multilingual Longcat Flash Chat leads

Longcat Flash Chat: 51.9 (#101), Magistral Medium: 39.6 (#224)

Multilingual benchmarks
BenchmarkLongcat Flash ChatMagistral Medium
LMArena Non-English14041232
LMArena Chinese14651227
LMArena French14561267
LMArena German14081248
LMArena Japanese13731175
LMArena Korean13711125
LMArena Russian13951224
LMArena Spanish14451271

Instruction Following Longcat Flash Chat leads

Longcat Flash Chat: 74.4 (#96), Magistral Medium: 66.0 (#211)

Instruction Following benchmarks
BenchmarkLongcat Flash ChatMagistral Medium
LMArena Instruction Following14111254

Long Context Longcat Flash Chat leads

Longcat Flash Chat: 43.5 (#93), Magistral Medium: 39.3 (#183)

Long Context benchmarks
BenchmarkLongcat Flash ChatMagistral Medium
LMArena Longer Query14251295

Writing & Preference Longcat Flash Chat leads

Longcat Flash Chat: 61.0 (#91), Magistral Medium: 46.3 (#219)

Writing & Preference benchmarks
BenchmarkLongcat Flash ChatMagistral Medium
LMArena Text14271255
LMArena Creative Writing13881245
LMArena Multi-Turn14181275

Frequently asked questions

Is Longcat Flash Chat better than Magistral Medium?

Longcat Flash Chat is the stronger model overall, scoring 42.1 to 35.2 on the Noometry Index.

Is Longcat Flash Chat or Magistral Medium better for coding?

Longcat Flash Chat scores higher on coding benchmarks: 43.5 versus 39.1 in the Noometry coding category.

How many benchmarks do Longcat Flash Chat and Magistral Medium share?

18 benchmarks have published results for both models. Longcat Flash Chat has 19 scored results on Noometry and Magistral Medium has 22.

Related comparisons

Go deeper