Model comparison

Amazon Nova Experimental Chat 26 01 10 vs Gemini 3.5 Flash Lite

Amazon Nova Experimental Chat 26 01 10 is the stronger model overall, scoring 42.8 to 41.5 on the Noometry Index.

Last verified . 13 shared benchmarks.

Gemini 3.5 Flash Lite Google

41.5

Rank #133 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Amazon Nova Experimental Chat 26 01 10 scores higher in 3 categories and Gemini 3.5 Flash Lite in 5 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in math, where Amazon Nova Experimental Chat 26 01 10 leads 38.5 to 25.9.

Side by side

Amazon Nova Experimental Chat 26 01 10 and Gemini 3.5 Flash Lite specifications
Amazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
ProviderAmazonGoogle
Noometry Index42.841.5
Released—2026-07-21
WeightsProprietaryProprietary
Context window—1.05M
Max output—66K
Input $ / M tokens—$0.30
Output $ / M tokens—$2.50
Results tracked1339

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Amazon Nova Experimental Chat 26 01 10: 42.7 (#96), Gemini 3.5 Flash Lite: 42.4 (#104)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Coding14471453
LMArena WebDev—1440
SciCode—41.3%
WeirdML—39%
ALE-Bench—765.27

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 26 01 10: —, Gemini 3.5 Flash Lite: 25.7 (#107)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
APEX-Agents—29.3%
GDP.pdf—10%

Reasoning Amazon Nova Experimental Chat 26 01 10 leads

Amazon Nova Experimental Chat 26 01 10: 28.9 (#98), Gemini 3.5 Flash Lite: 27.8 (#114)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Hard Prompts14151441
ARC-AGI-2—10.3%
NYT Connections (extended)—60.4%
ARC-AGI-1—53.5%
CritPt—0%
Chess Puzzles—22%
Mystery Game Puzzles—19%
DTBench—83.5%
LMCA—37.6%
Epoch Capabilities Index—145.13

Math Amazon Nova Experimental Chat 26 01 10 leads

Amazon Nova Experimental Chat 26 01 10: 38.5 (#136), Gemini 3.5 Flash Lite: 25.9 (#264)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Math14041433
FrontierMath (Tiers 1-3)—26%
FrontierMath Tier 4—0%
OTIS Mock AIME 2024-2025—71.1%
ProofBench—13%

Knowledge Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 26 01 10: 40.3 (#120), Gemini 3.5 Flash Lite: 50.1 (#72)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Expert14441435
GPQA Diamond—83.3%

Multimodal Not comparable

Amazon Nova Experimental Chat 26 01 10: —, Gemini 3.5 Flash Lite: 41.1 (#40)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Vision—1268

Multilingual Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 26 01 10: 50.2 (#126), Gemini 3.5 Flash Lite: 53.5 (#63)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Non-English13811427
LMArena Chinese13721469
LMArena Russian13911443
LMArena Spanish13901442
LMArena French—1451
LMArena German—1454
LMArena Japanese—1427
LMArena Korean—1407

Instruction Following Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 26 01 10: 72.9 (#126), Gemini 3.5 Flash Lite: 74.8 (#85)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Instruction Following13811420

Long Context Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 26 01 10: 42.7 (#119), Gemini 3.5 Flash Lite: 43.9 (#84)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Longer Query14001435

Writing & Preference Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 26 01 10: 57.4 (#129), Gemini 3.5 Flash Lite: 64.2 (#57)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Gemini 3.5 Flash Lite
LMArena Text13961435
LMArena Creative Writing13311420
LMArena Multi-Turn13801445
EQ-Bench Creative Writing—1559

Frequently asked questions

Is Amazon Nova Experimental Chat 26 01 10 better than Gemini 3.5 Flash Lite?

Amazon Nova Experimental Chat 26 01 10 is the stronger model overall, scoring 42.8 to 41.5 on the Noometry Index.

Is Amazon Nova Experimental Chat 26 01 10 or Gemini 3.5 Flash Lite better for coding?

They score almost the same on coding (42.7 vs 42.4); test both on your own repository before choosing.

How many benchmarks do Amazon Nova Experimental Chat 26 01 10 and Gemini 3.5 Flash Lite share?

13 benchmarks have published results for both models. Amazon Nova Experimental Chat 26 01 10 has 13 scored results on Noometry and Gemini 3.5 Flash Lite has 39.

Related comparisons

Go deeper