Model comparison

Gemini 1.5 Flash 8B vs Longcat Flash Chat

Longcat Flash Chat is the stronger model overall, scoring 42.1 to 29.9 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini 1.5 Flash 8B Google

29.9

Rank #301 Confirmed

Longcat Flash Chat Meituan

42.1

Rank #120 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Gemini 1.5 Flash 8B scores higher in 1 category and Longcat Flash Chat in 7 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in math, where Longcat Flash Chat leads 39.4 to 14.2.
  • Longcat Flash Chat has downloadable open weights; the other is API-only.

Side by side

Gemini 1.5 Flash 8B and Longcat Flash Chat specifications
Gemini 1.5 Flash 8BLongcat Flash Chat
ProviderGoogleMeituan
Noometry Index29.942.1
Released2024-10-03—
WeightsProprietaryOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2119

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Longcat Flash Chat leads

Gemini 1.5 Flash 8B: 35.5 (#225), Longcat Flash Chat: 43.5 (#87)

Coding benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Coding12181471

Reasoning Too close to call

Gemini 1.5 Flash 8B: 20.0 (#244), Longcat Flash Chat: 19.0 (#272)

Reasoning benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Hard Prompts12091440
Kagi LLM Benchmark—43.9%
NYT Connections (extended)—17.7%
DTBench50%—

Math Longcat Flash Chat leads

Gemini 1.5 Flash 8B: 14.2 (#302), Longcat Flash Chat: 39.4 (#107)

Math benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Math12071442
OTIS Mock AIME 2024-20254.6%—

Knowledge Longcat Flash Chat leads

Gemini 1.5 Flash 8B: 16.0 (#289), Longcat Flash Chat: 40.6 (#116)

Knowledge benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Expert11851454
GPQA Diamond33%—

Multimodal Not comparable

Gemini 1.5 Flash 8B: 28.2 (#115), Longcat Flash Chat: —

Multimodal benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Vision1044—

Multilingual Longcat Flash Chat leads

Gemini 1.5 Flash 8B: 38.5 (#229), Longcat Flash Chat: 51.9 (#101)

Multilingual benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Non-English12151404
LMArena Chinese12311465
LMArena French12341456
LMArena German12061408
LMArena Japanese11501373
LMArena Korean11401371
LMArena Russian12361395
LMArena Spanish12121445

Instruction Following Longcat Flash Chat leads

Gemini 1.5 Flash 8B: 62.8 (#236), Longcat Flash Chat: 74.4 (#96)

Instruction Following benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Instruction Following11991411

Long Context Longcat Flash Chat leads

Gemini 1.5 Flash 8B: 37.0 (#225), Longcat Flash Chat: 43.5 (#93)

Long Context benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Longer Query12191425

Writing & Preference Longcat Flash Chat leads

Gemini 1.5 Flash 8B: 42.8 (#232), Longcat Flash Chat: 61.0 (#91)

Writing & Preference benchmarks
BenchmarkGemini 1.5 Flash 8BLongcat Flash Chat
LMArena Text12261427
LMArena Creative Writing12181388
LMArena Multi-Turn11851418

Frequently asked questions

Is Gemini 1.5 Flash 8B better than Longcat Flash Chat?

Longcat Flash Chat is the stronger model overall, scoring 42.1 to 29.9 on the Noometry Index.

Is Gemini 1.5 Flash 8B or Longcat Flash Chat better for coding?

Longcat Flash Chat scores higher on coding benchmarks: 43.5 versus 35.5 in the Noometry coding category.

How many benchmarks do Gemini 1.5 Flash 8B and Longcat Flash Chat share?

17 benchmarks have published results for both models. Gemini 1.5 Flash 8B has 21 scored results on Noometry and Longcat Flash Chat has 19.

Related comparisons

Go deeper