Model comparison

Amazon Nova Experimental Chat 12 10 vs Gemma 3 1B

Amazon Nova Experimental Chat 12 10 is the stronger model overall, scoring 42.9 to 21.1 on the Noometry Index.

Last verified . 0 shared benchmarks.

Gemma 3 1B Google

21.1

Rank #353 Reported

Summary

  • The widest gap is in knowledge, where Amazon Nova Experimental Chat 12 10 leads 39.2 to 7.0.
  • Gemma 3 1B has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Experimental Chat 12 10 and Gemma 3 1B specifications
Amazon Nova Experimental Chat 12 10Gemma 3 1B
ProviderAmazonGoogle
Noometry Index42.921.1
Released—2025-03-12
WeightsProprietaryOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked124

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

Amazon Nova Experimental Chat 12 10: 42.2 (#110), Gemma 3 1B: —

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
LMArena Coding1430—

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 12 10: —, Gemma 3 1B: 13.7 (#152)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
Berkeley Function Calling Leaderboard—7.2%

Reasoning Amazon Nova Experimental Chat 12 10 leads

Amazon Nova Experimental Chat 12 10: 29.3 (#94), Gemma 3 1B: 19.2 (#264)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
Chess Puzzles—0%
LMArena Hard Prompts1427—

Math Amazon Nova Experimental Chat 12 10 leads

Amazon Nova Experimental Chat 12 10: 38.9 (#124), Gemma 3 1B: 10.2 (#316)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
OTIS Mock AIME 2024-2025—1.1%
LMArena Math1419—

Knowledge Amazon Nova Experimental Chat 12 10 leads

Amazon Nova Experimental Chat 12 10: 39.2 (#136), Gemma 3 1B: 7.0 (#314)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
GPQA Diamond—19.9%
LMArena Expert1408—

Multilingual Not comparable

Amazon Nova Experimental Chat 12 10: 51.4 (#108), Gemma 3 1B: —

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
LMArena Non-English1398—
LMArena Chinese1440—
LMArena Russian1395—

Instruction Following Not comparable

Amazon Nova Experimental Chat 12 10: 73.2 (#123), Gemma 3 1B: —

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
LMArena Instruction Following1387—

Long Context Not comparable

Amazon Nova Experimental Chat 12 10: 42.4 (#125), Gemma 3 1B: —

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
LMArena Longer Query1391—

Writing & Preference Not comparable

Amazon Nova Experimental Chat 12 10: 59.5 (#110), Gemma 3 1B: —

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Gemma 3 1B
LMArena Text1420—
LMArena Creative Writing1350—
LMArena Multi-Turn1409—

Frequently asked questions

Is Amazon Nova Experimental Chat 12 10 better than Gemma 3 1B?

Amazon Nova Experimental Chat 12 10 is the stronger model overall, scoring 42.9 to 21.1 on the Noometry Index.

How many benchmarks do Amazon Nova Experimental Chat 12 10 and Gemma 3 1B share?

0 benchmarks have published results for both models. Amazon Nova Experimental Chat 12 10 has 12 scored results on Noometry and Gemma 3 1B has 4.

Related comparisons

Go deeper