Model comparison

Amazon Nova Experimental Chat 26 02 10 vs Gemini 3.1 Flash Lite

Amazon Nova Experimental Chat 26 02 10 is the stronger model overall, scoring 44.5 to 40.8 on the Noometry Index.

Last verified . 12 shared benchmarks.

Gemini 3.1 Flash Lite Google

40.8

Rank #144 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 26 02 10 scores higher in 7 categories and Gemini 3.1 Flash Lite in 1 category; 6 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Amazon Nova Experimental Chat 26 02 10 leads 30.1 to 22.9.

Side by side

Amazon Nova Experimental Chat 26 02 10 and Gemini 3.1 Flash Lite specifications
Amazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
ProviderAmazonGoogle
Noometry Index44.540.8
Released—2026-03-03
WeightsProprietaryProprietary
Context window—1.05M
Max output—66K
Input $ / M tokens—$0.25
Output $ / M tokens—$1.50
Results tracked1238

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 43.9 (#82), Gemini 3.1 Flash Lite: 37.8 (#188)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Coding14831400
LMArena WebDev—1256
SciCode—41.9%
WeirdML—52.2%
ALE-Bench—797.73

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 26 02 10: —, Gemini 3.1 Flash Lite: 30.2 (#79)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
DeepResearch Bench—37.3%

Reasoning Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 30.1 (#86), Gemini 3.1 Flash Lite: 22.9 (#186)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Hard Prompts14581407
Kagi LLM Benchmark—67.2%
NYT Connections (extended)—8.2%
CritPt—1.1%
Chess Puzzles—25%
EnigmaEval—3%
Thematic Generalization—63.3%
DTBench—76.8%
LMCA—35%
Epoch Capabilities Index—144.47
ForecastBench—54.4

Math Gemini 3.1 Flash Lite leads

Amazon Nova Experimental Chat 26 02 10: 39.3 (#109), Gemini 3.1 Flash Lite: 40.7 (#90)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Math14381428
FrontierMath (Tiers 1-3)—27.7%
OTIS Mock AIME 2024-2025—80%

Knowledge Too close to call

Amazon Nova Experimental Chat 26 02 10: 42.3 (#97), Gemini 3.1 Flash Lite: 41.9 (#104)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Expert15061398
GPQA Diamond—81.8%
Humanity's Last Exam—8.6%
Vectara Hallucination Rate—8.2%

Multimodal Not comparable

Amazon Nova Experimental Chat 26 02 10: —, Gemini 3.1 Flash Lite: 39.4 (#60)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Vision—1240

Multilingual Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 54.0 (#50), Gemini 3.1 Flash Lite: 52.3 (#86)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Non-English14341411
LMArena Chinese14631461
LMArena Russian14231420
LMArena French—1424
LMArena German—1429
LMArena Japanese—1413
LMArena Korean—1392
LMArena Spanish—1421

Instruction Following Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 75.2 (#69), Gemini 3.1 Flash Lite: 72.7 (#131)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Instruction Following14271377

Long Context Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 44.0 (#77), Gemini 3.1 Flash Lite: 42.5 (#122)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Longer Query14411394

Writing & Preference Too close to call

Amazon Nova Experimental Chat 26 02 10: 61.8 (#84), Gemini 3.1 Flash Lite: 60.9 (#94)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Gemini 3.1 Flash Lite
LMArena Text14481416
LMArena Creative Writing13681401
LMArena Multi-Turn14421417

Frequently asked questions

Is Amazon Nova Experimental Chat 26 02 10 better than Gemini 3.1 Flash Lite?

Amazon Nova Experimental Chat 26 02 10 is the stronger model overall, scoring 44.5 to 40.8 on the Noometry Index.

Is Amazon Nova Experimental Chat 26 02 10 or Gemini 3.1 Flash Lite better for coding?

Amazon Nova Experimental Chat 26 02 10 scores higher on coding benchmarks: 43.9 versus 37.8 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 26 02 10 and Gemini 3.1 Flash Lite share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 26 02 10 has 12 scored results on Noometry and Gemini 3.1 Flash Lite has 38.

Related comparisons

Go deeper