Model comparison

Amazon Nova Experimental Chat 12 10 vs Gemini 3.5 Flash Lite

Amazon Nova Experimental Chat 12 10 is the stronger model overall, scoring 42.9 to 41.5 on the Noometry Index.

Last verified . 12 shared benchmarks.

Gemini 3.5 Flash Lite Google

41.5

Rank #133 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 12 10 scores higher in 2 categories and Gemini 3.5 Flash Lite in 6 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in math, where Amazon Nova Experimental Chat 12 10 leads 38.9 to 25.9.

Side by side

Amazon Nova Experimental Chat 12 10 and Gemini 3.5 Flash Lite specifications
Amazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
ProviderAmazonGoogle
Noometry Index42.941.5
Released—2026-07-21
WeightsProprietaryProprietary
Context window—1.05M
Max output—66K
Input $ / M tokens—$0.30
Output $ / M tokens—$2.50
Results tracked1239

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Amazon Nova Experimental Chat 12 10: 42.2 (#110), Gemini 3.5 Flash Lite: 42.4 (#104)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Coding14301453
LMArena WebDev—1440
SciCode—41.3%
WeirdML—39%
ALE-Bench—765.27

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 12 10: —, Gemini 3.5 Flash Lite: 25.7 (#107)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
APEX-Agents—29.3%
GDP.pdf—10%

Reasoning Amazon Nova Experimental Chat 12 10 leads

Amazon Nova Experimental Chat 12 10: 29.3 (#94), Gemini 3.5 Flash Lite: 27.8 (#114)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Hard Prompts14271441
ARC-AGI-2—10.3%
NYT Connections (extended)—60.4%
ARC-AGI-1—53.5%
CritPt—0%
Chess Puzzles—22%
Mystery Game Puzzles—19%
DTBench—83.5%
LMCA—37.6%
Epoch Capabilities Index—145.13

Math Amazon Nova Experimental Chat 12 10 leads

Amazon Nova Experimental Chat 12 10: 38.9 (#124), Gemini 3.5 Flash Lite: 25.9 (#264)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Math14191433
FrontierMath (Tiers 1-3)—26%
FrontierMath Tier 4—0%
OTIS Mock AIME 2024-2025—71.1%
ProofBench—13%

Knowledge Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 12 10: 39.2 (#136), Gemini 3.5 Flash Lite: 50.1 (#72)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Expert14081435
GPQA Diamond—83.3%

Multimodal Not comparable

Amazon Nova Experimental Chat 12 10: —, Gemini 3.5 Flash Lite: 41.1 (#40)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Vision—1268

Multilingual Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 12 10: 51.4 (#108), Gemini 3.5 Flash Lite: 53.5 (#63)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Non-English13981427
LMArena Chinese14401469
LMArena Russian13951443
LMArena French—1451
LMArena German—1454
LMArena Japanese—1427
LMArena Korean—1407
LMArena Spanish—1442

Instruction Following Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 12 10: 73.2 (#123), Gemini 3.5 Flash Lite: 74.8 (#85)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Instruction Following13871420

Long Context Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 12 10: 42.4 (#125), Gemini 3.5 Flash Lite: 43.9 (#84)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Longer Query13911435

Writing & Preference Gemini 3.5 Flash Lite leads

Amazon Nova Experimental Chat 12 10: 59.5 (#110), Gemini 3.5 Flash Lite: 64.2 (#57)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemini 3.5 Flash Lite
LMArena Text14201435
LMArena Creative Writing13501420
LMArena Multi-Turn14091445
EQ-Bench Creative Writing—1559

Frequently asked questions

Is Amazon Nova Experimental Chat 12 10 better than Gemini 3.5 Flash Lite?

Amazon Nova Experimental Chat 12 10 is the stronger model overall, scoring 42.9 to 41.5 on the Noometry Index.

Is Amazon Nova Experimental Chat 12 10 or Gemini 3.5 Flash Lite better for coding?

They score almost the same on coding (42.2 vs 42.4); test both on your own repository before choosing.

How many benchmarks do Amazon Nova Experimental Chat 12 10 and Gemini 3.5 Flash Lite share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 12 10 has 12 scored results on Noometry and Gemini 3.5 Flash Lite has 39.

Related comparisons

Go deeper