Model comparison

Amazon Nova Experimental Chat 10 20 vs Gemini 3.1 Flash Lite

Amazon Nova Experimental Chat 10 20 is the stronger model overall, scoring 42.1 to 40.8 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini 3.1 Flash Lite Google

40.8

Rank #144 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Amazon Nova Experimental Chat 10 20 scores higher in 2 categories and Gemini 3.1 Flash Lite in 6 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Amazon Nova Experimental Chat 10 20 leads 28.4 to 22.9.

Side by side

Amazon Nova Experimental Chat 10 20 and Gemini 3.1 Flash Lite specifications
Amazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
ProviderAmazonGoogle
Noometry Index42.140.8
Released—2026-03-03
WeightsProprietaryProprietary
Context window—1.05M
Max output—66K
Input $ / M tokens—$0.25
Output $ / M tokens—$1.50
Results tracked1738

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 41.6 (#123), Gemini 3.1 Flash Lite: 37.8 (#188)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Coding14121400
LMArena WebDev—1256
SciCode—41.9%
WeirdML—52.2%
ALE-Bench—797.73

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 10 20: —, Gemini 3.1 Flash Lite: 30.2 (#79)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
DeepResearch Bench—37.3%

Reasoning Amazon Nova Experimental Chat 10 20 leads

Amazon Nova Experimental Chat 10 20: 28.4 (#106), Gemini 3.1 Flash Lite: 22.9 (#186)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Hard Prompts13961407
Kagi LLM Benchmark—67.2%
NYT Connections (extended)—8.2%
CritPt—1.1%
Chess Puzzles—25%
EnigmaEval—3%
Thematic Generalization—63.3%
DTBench—76.8%
LMCA—35%
Epoch Capabilities Index—144.47
ForecastBench—54.4

Math Gemini 3.1 Flash Lite leads

Amazon Nova Experimental Chat 10 20: 39.0 (#119), Gemini 3.1 Flash Lite: 40.7 (#90)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Math14251428
FrontierMath (Tiers 1-3)—27.7%
OTIS Mock AIME 2024-2025—80%

Knowledge Gemini 3.1 Flash Lite leads

Amazon Nova Experimental Chat 10 20: 38.5 (#144), Gemini 3.1 Flash Lite: 41.9 (#104)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Expert13861398
GPQA Diamond—81.8%
Humanity's Last Exam—8.6%
Vectara Hallucination Rate—8.2%

Multimodal Not comparable

Amazon Nova Experimental Chat 10 20: —, Gemini 3.1 Flash Lite: 39.4 (#60)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Vision—1240

Multilingual Gemini 3.1 Flash Lite leads

Amazon Nova Experimental Chat 10 20: 49.5 (#131), Gemini 3.1 Flash Lite: 52.3 (#86)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Non-English13721411
LMArena Chinese14041461
LMArena French14251424
LMArena German13911429
LMArena Japanese13601413
LMArena Korean13241392
LMArena Russian13711420
LMArena Spanish13821421

Instruction Following Too close to call

Amazon Nova Experimental Chat 10 20: 72.1 (#141), Gemini 3.1 Flash Lite: 72.7 (#131)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Instruction Following13651377

Long Context Too close to call

Amazon Nova Experimental Chat 10 20: 41.7 (#133), Gemini 3.1 Flash Lite: 42.5 (#122)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Longer Query13701394

Writing & Preference Gemini 3.1 Flash Lite leads

Amazon Nova Experimental Chat 10 20: 56.6 (#136), Gemini 3.1 Flash Lite: 60.9 (#94)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Gemini 3.1 Flash Lite
LMArena Text13941416
LMArena Creative Writing13181401
LMArena Multi-Turn13641417

Frequently asked questions

Is Amazon Nova Experimental Chat 10 20 better than Gemini 3.1 Flash Lite?

Amazon Nova Experimental Chat 10 20 is the stronger model overall, scoring 42.1 to 40.8 on the Noometry Index.

Is Amazon Nova Experimental Chat 10 20 or Gemini 3.1 Flash Lite better for coding?

Amazon Nova Experimental Chat 10 20 scores higher on coding benchmarks: 41.6 versus 37.8 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 10 20 and Gemini 3.1 Flash Lite share?

17 benchmarks have published results for both models. Amazon Nova Experimental Chat 10 20 has 17 scored results on Noometry and Gemini 3.1 Flash Lite has 38.

Related comparisons

Go deeper