Model comparison

Amazon Nova Experimental Chat 11 10 vs Gemini 3.5 Flash Lite

Amazon Nova Experimental Chat 11 10 is the stronger model overall, scoring 43.0 to 41.5 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini 3.5 Flash Lite Google

41.5

Rank #133 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Amazon Nova Experimental Chat 11 10 scores higher in 2 categories and Gemini 3.5 Flash Lite in 6 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in math, where Amazon Nova Experimental Chat 11 10 leads 39.1 to 25.9.

Side by side

Amazon Nova Experimental Chat 11 10 and Gemini 3.5 Flash Lite specifications
Amazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
ProviderAmazonGoogle
Noometry Index43.041.5
Released—2026-07-21
WeightsProprietaryProprietary
Context window—1.05M
Max output—66K
Input $ / M tokens—$0.30
Output $ / M tokens—$2.50
Results tracked1739

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Amazon Nova Experimental Chat 11 10: 42.3 (#107), Gemini 3.5 Flash Lite: 42.4 (#104)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Coding14331453
LMArena WebDev—1440
SciCode—41.3%
WeirdML—39%
ALE-Bench—765.27

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 11 10: —, Gemini 3.5 Flash Lite: 25.7 (#107)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
APEX-Agents—29.3%
GDP.pdf—10%

Reasoning Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 29.1 (#95), Gemini 3.5 Flash Lite: 27.8 (#114)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Hard Prompts14221441
ARC-AGI-2—10.3%
NYT Connections (extended)—60.4%
ARC-AGI-1—53.5%
CritPt—0%
Chess Puzzles—22%
Mystery Game Puzzles—19%
DTBench—83.5%
LMCA—37.6%
Epoch Capabilities Index—145.13

Math Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 39.1 (#114), Gemini 3.5 Flash Lite: 25.9 (#264)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Math14311433
FrontierMath (Tiers 1-3)—26%
FrontierMath Tier 4—0%
OTIS Mock AIME 2024-2025—71.1%
ProofBench—13%

Knowledge Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 11 10: 39.9 (#127), Gemini 3.5 Flash Lite: 50.1 (#72)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Expert14311435
GPQA Diamond—83.3%

Multimodal Not comparable

Amazon Nova Experimental Chat 11 10: —, Gemini 3.5 Flash Lite: 41.1 (#40)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Vision—1268

Multilingual Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 11 10: 51.9 (#98), Gemini 3.5 Flash Lite: 53.5 (#63)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Non-English14051427
LMArena Chinese14631469
LMArena French14491451
LMArena German13951454
LMArena Japanese13831427
LMArena Korean13841407
LMArena Russian13941443
LMArena Spanish14441442

Instruction Following Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 11 10: 73.2 (#122), Gemini 3.5 Flash Lite: 74.8 (#85)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Instruction Following13871420

Long Context Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 11 10: 42.5 (#121), Gemini 3.5 Flash Lite: 43.9 (#84)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Longer Query13951435

Writing & Preference Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 11 10: 58.8 (#114), Gemini 3.5 Flash Lite: 64.2 (#57)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Gemini 3.5 Flash Lite
LMArena Text14151435
LMArena Creative Writing13491420
LMArena Multi-Turn13801445
EQ-Bench Creative Writing—1559

Frequently asked questions

Is Amazon Nova Experimental Chat 11 10 better than Gemini 3.5 Flash Lite?

Amazon Nova Experimental Chat 11 10 is the stronger model overall, scoring 43.0 to 41.5 on the Noometry Index.

Is Amazon Nova Experimental Chat 11 10 or Gemini 3.5 Flash Lite better for coding?

They score almost the same on coding (42.3 vs 42.4); test both on your own repository before choosing.

How many benchmarks do Amazon Nova Experimental Chat 11 10 and Gemini 3.5 Flash Lite share?

17 benchmarks have published results for both models. Amazon Nova Experimental Chat 11 10 has 17 scored results on Noometry and Gemini 3.5 Flash Lite has 39.

Related comparisons

Go deeper