Model comparison

Amazon Nova Experimental Chat 10 09 vs Gemma 3 12B

Amazon Nova Experimental Chat 10 09 is the stronger model overall, scoring 41.9 to 32.1 on the Noometry Index.

Last verified . 8 shared benchmarks.

Gemma 3 12B Google

32.1

Rank #262 Confirmed

Summary

  • They share 8 benchmarks with published results for both. Amazon Nova Experimental Chat 10 09 scores higher in 6 categories and Gemma 3 12B in 0 categories; 4 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Amazon Nova Experimental Chat 10 09 leads 27.3 to 15.7.
  • Gemma 3 12B has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Experimental Chat 10 09 and Gemma 3 12B specifications
Amazon Nova Experimental Chat 10 09Gemma 3 12B
ProviderAmazonGoogle
Noometry Index41.932.1
Released—2025-03-12
WeightsProprietaryOpen
Context window—131K
Max output—8K
Input $ / M tokens—$0.05
Output $ / M tokens—$0.15
Results tracked924

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 40.2 (#145), Gemma 3 12B: 31.7 (#280)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
LMArena Coding13701281
SciCode—17.4%

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 10 09: —, Gemma 3 12B: 25.5 (#108)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
Berkeley Function Calling Leaderboard—30.4%

Reasoning Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 27.3 (#120), Gemma 3 12B: 15.7 (#313)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
LMArena Hard Prompts13561309
CritPt—0%
Chess Puzzles—0%
DTBench—48.8%
LMCA—4.5%
Epoch Capabilities Index—123.5

Math Not comparable

Amazon Nova Experimental Chat 10 09: —, Gemma 3 12B: 22.3 (#279)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
OTIS Mock AIME 2024-2025—16.7%
LMArena Math—1307

Knowledge Not comparable

Amazon Nova Experimental Chat 10 09: —, Gemma 3 12B: 26.5 (#257)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
GPQA Diamond—39.5%
Vectara Hallucination Rate—4.4%
LMArena Expert—1248

Multimodal Not comparable

Amazon Nova Experimental Chat 10 09: —, Gemma 3 12B: —

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
MindCube—46.7%

Multilingual Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 47.3 (#150), Gemma 3 12B: 45.7 (#165)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
LMArena Non-English13401318
LMArena Chinese1341—
LMArena German—1370
LMArena Russian—1335

Instruction Following Too close to call

Amazon Nova Experimental Chat 10 09: 69.4 (#172), Gemma 3 12B: 68.6 (#186)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
LMArena Instruction Following13151299

Long Context Too close to call

Amazon Nova Experimental Chat 10 09: 40.5 (#152), Gemma 3 12B: 40.0 (#162)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
LMArena Longer Query13331317

Writing & Preference Amazon Nova Experimental Chat 10 09 leads

Amazon Nova Experimental Chat 10 09: 54.7 (#149), Gemma 3 12B: 47.5 (#209)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 10 09Gemma 3 12B
LMArena Text13641334
LMArena Creative Writing13071331
LMArena Multi-Turn13551334
EQ-Bench Creative Writing—1126

Frequently asked questions

Is Amazon Nova Experimental Chat 10 09 better than Gemma 3 12B?

Amazon Nova Experimental Chat 10 09 is the stronger model overall, scoring 41.9 to 32.1 on the Noometry Index.

Is Amazon Nova Experimental Chat 10 09 or Gemma 3 12B better for coding?

Amazon Nova Experimental Chat 10 09 scores higher on coding benchmarks: 40.2 versus 31.7 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 10 09 and Gemma 3 12B share?

8 benchmarks have published results for both models. Amazon Nova Experimental Chat 10 09 has 9 scored results on Noometry and Gemma 3 12B has 24.

Related comparisons

Go deeper