Model comparison

Gemma 3n E4b IT vs Llama 3.2 1B

Gemma 3n E4b IT is the stronger model overall, scoring 37.3 to 20.1 on the Noometry Index.

Last verified . 13 shared benchmarks.

Gemma 3n E4b IT Google

37.3

Rank #206 Confirmed

Llama 3.2 1B Meta

20.1

Rank #354 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Gemma 3n E4b IT scores higher in 8 categories and Llama 3.2 1B in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Gemma 3n E4b IT leads 50.1 to 21.3.

Side by side

Gemma 3n E4b IT and Llama 3.2 1B specifications
Gemma 3n E4b ITLlama 3.2 1B
ProviderGoogleMeta
Noometry Index37.320.1
Released—2024-09-24
WeightsOpenOpen
Context window—60K
Max output—54K
Input $ / M tokens—$0.027
Output $ / M tokens—$0.20
Results tracked1822

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemma 3n E4b IT leads

Gemma 3n E4b IT: 37.0 (#198), Llama 3.2 1B: 21.1 (#338)

Coding benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
LMArena Coding12681070
BigCodeBench Instruct—8.2%
BigCodeBench Complete—11.3%

Agentic & Tool Use Not comparable

Gemma 3n E4b IT: —, Llama 3.2 1B: 14.6 (#150)

Agentic & Tool Use benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
Berkeley Function Calling Leaderboard—10.8%
BALROG—6.6%

Reasoning Gemma 3n E4b IT leads

Gemma 3n E4b IT: 19.9 (#247), Llama 3.2 1B: 16.2 (#308)

Reasoning benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
LMArena Hard Prompts12841044
Kagi LLM Benchmark31.5%—
Chess Puzzles—0%
Epoch Capabilities Index—101.99

Math Gemma 3n E4b IT leads

Gemma 3n E4b IT: 35.1 (#188), Llama 3.2 1B: 10.4 (#313)

Math benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
LMArena Math12511086
OTIS Mock AIME 2024-2025—0.6%

Knowledge Gemma 3n E4b IT leads

Gemma 3n E4b IT: 34.2 (#198), Llama 3.2 1B: 7.2 (#312)

Knowledge benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
LMArena Expert12461007
GPQA Diamond—23.9%

Multilingual Gemma 3n E4b IT leads

Gemma 3n E4b IT: 43.4 (#183), Llama 3.2 1B: 23.8 (#292)

Multilingual benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
LMArena Non-English1285973
LMArena Chinese1309959
LMArena German13111014
LMArena Russian1288941
LMArena French1330—
LMArena Japanese1272—
LMArena Korean1259—
LMArena Spanish1305—

Instruction Following Gemma 3n E4b IT leads

Gemma 3n E4b IT: 66.1 (#210), Llama 3.2 1B: 52.4 (#290)

Instruction Following benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
LMArena Instruction Following12551031

Long Context Gemma 3n E4b IT leads

Gemma 3n E4b IT: 38.7 (#191), Llama 3.2 1B: 31.9 (#274)

Long Context benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
LMArena Longer Query12761050

Writing & Preference Gemma 3n E4b IT leads

Gemma 3n E4b IT: 50.1 (#186), Llama 3.2 1B: 21.3 (#310)

Writing & Preference benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 1B
LMArena Text13061055
LMArena Creative Writing12871033
LMArena Multi-Turn12761030
EQ-Bench Creative Writing—200

Frequently asked questions

Is Gemma 3n E4b IT better than Llama 3.2 1B?

Gemma 3n E4b IT is the stronger model overall, scoring 37.3 to 20.1 on the Noometry Index.

Is Gemma 3n E4b IT or Llama 3.2 1B better for coding?

Gemma 3n E4b IT scores higher on coding benchmarks: 37.0 versus 21.1 in the Noometry coding category.

How many benchmarks do Gemma 3n E4b IT and Llama 3.2 1B share?

13 benchmarks have published results for both models. Gemma 3n E4b IT has 18 scored results on Noometry and Llama 3.2 1B has 22.

Related comparisons

Go deeper