Model comparison

Gemini 3.1 Flash Lite vs Qwen Max

Gemini 3.1 Flash Lite is the stronger model overall, scoring 40.8 to 34.7 on the Noometry Index.

Last verified . 19 shared benchmarks.

Gemini 3.1 Flash Lite Google

40.8

Rank #144 Confirmed

Qwen Max Alibaba (Qwen)

34.7

Rank #230 Confirmed

Summary

  • They share 19 benchmarks with published results for both. Gemini 3.1 Flash Lite scores higher in 7 categories and Qwen Max in 1 category; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Gemini 3.1 Flash Lite leads 40.7 to 22.3.
  • The biggest single-benchmark swing is OTIS Mock AIME 2024-2025: 80% for Gemini 3.1 Flash Lite and 16.1% for Qwen Max.
  • Gemini 3.1 Flash Lite is cheaper at $0.25 / $1.50 per million input/output tokens, against $1.60 / $6.40 for Qwen Max.
  • Gemini 3.1 Flash Lite accepts more context: 1.05M tokens versus 33K.

Side by side

Gemini 3.1 Flash Lite and Qwen Max specifications
Gemini 3.1 Flash LiteQwen Max
ProviderGoogleAlibaba (Qwen)
Noometry Index40.834.7
Released2026-03-032024-04-03
WeightsProprietaryProprietary
Context window1.05M33K
Max output66K8K
Input $ / M tokens$0.25$1.60
Output $ / M tokens$1.50$6.40
Results tracked3823

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 37.8 (#188), Qwen Max: 30.7 (#292)

Coding benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
LMArena Coding14001288
Aider Polyglot—21.8%
LMArena WebDev1256—
SciCode41.9%—
WeirdML52.2%—
ALE-Bench797.73—

Agentic & Tool Use Not comparable

Gemini 3.1 Flash Lite: 30.2 (#79), Qwen Max: —

Agentic & Tool Use benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
DeepResearch Bench37.3%—

Reasoning Qwen Max leads

Gemini 3.1 Flash Lite: 22.9 (#186), Qwen Max: 25.1 (#151)

Reasoning benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
LMArena Hard Prompts14071269
Kagi LLM Benchmark67.2%—
NYT Connections (extended)8.2%—
CritPt1.1%—
Chess Puzzles25%—
EnigmaEval3%—
Thematic Generalization63.3%—
DTBench76.8%—
LMCA35%—
Epoch Capabilities Index144.47—
ForecastBench54.4—

Math Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 40.7 (#90), Qwen Max: 22.3 (#276)

Math benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
OTIS Mock AIME 2024-202580%16.1%
LMArena Math14281275
FrontierMath (Tiers 1-3)27.7%—
MATH Level 5—67.2%
FrontierMath (Feb 2025 set)—1%

Knowledge Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 41.9 (#104), Qwen Max: 30.3 (#228)

Knowledge benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
GPQA Diamond81.8%56.1%
LMArena Expert13981248
Humanity's Last Exam8.6%—
Vectara Hallucination Rate8.2%—

Multimodal Not comparable

Gemini 3.1 Flash Lite: 39.4 (#60), Qwen Max: —

Multimodal benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
LMArena Vision1240—

Multilingual Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 52.3 (#86), Qwen Max: 41.8 (#202)

Multilingual benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
LMArena Non-English14111263
LMArena Chinese14611254
LMArena French14241330
LMArena German14291254
LMArena Japanese14131205
LMArena Korean13921142
LMArena Russian14201274
LMArena Spanish14211290

Instruction Following Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 72.7 (#131), Qwen Max: 66.5 (#208)

Instruction Following benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
LMArena Instruction Following13771262

Long Context Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 42.5 (#122), Qwen Max: 39.4 (#180)

Long Context benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
LMArena Longer Query13941288
Fiction.LiveBench—66.7%

Writing & Preference Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 60.9 (#94), Qwen Max: 47.8 (#205)

Writing & Preference benchmarks
BenchmarkGemini 3.1 Flash LiteQwen Max
LMArena Text14161282
LMArena Creative Writing14011248
LMArena Multi-Turn14171277

Frequently asked questions

Is Gemini 3.1 Flash Lite better than Qwen Max?

Gemini 3.1 Flash Lite is the stronger model overall, scoring 40.8 to 34.7 on the Noometry Index.

Which is cheaper, Gemini 3.1 Flash Lite or Qwen Max?

Gemini 3.1 Flash Lite is cheaper. It lists at $0.25 per million input tokens and $1.50 per million output tokens; Qwen Max lists at $1.60 and $6.40.

Is Gemini 3.1 Flash Lite or Qwen Max better for coding?

Gemini 3.1 Flash Lite scores higher on coding benchmarks: 37.8 versus 30.7 in the Noometry coding category.

Which has the bigger context window?

Gemini 3.1 Flash Lite does, with 1.05M tokens against 33K.

How many benchmarks do Gemini 3.1 Flash Lite and Qwen Max share?

19 benchmarks have published results for both models. Gemini 3.1 Flash Lite has 38 scored results on Noometry and Qwen Max has 23.

Related comparisons

Go deeper