Model comparison

Gemma 3n E4b IT vs Llama 3.2 3B

Gemma 3n E4b IT is the stronger model overall, scoring 37.3 to 28.9 on the Noometry Index.

Last verified . 13 shared benchmarks.

Gemma 3n E4b IT Google

37.3

Rank #206 Confirmed

Llama 3.2 3B Meta

28.9

Rank #321 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Gemma 3n E4b IT scores higher in 7 categories and Llama 3.2 3B in 1 category; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Gemma 3n E4b IT leads 50.1 to 24.7.

Side by side

Gemma 3n E4b IT and Llama 3.2 3B specifications
Gemma 3n E4b ITLlama 3.2 3B
ProviderGoogleMeta
Noometry Index37.328.9
Released—2024-09-24
WeightsOpenOpen
Context window—131K
Max output—118K
Input $ / M tokens—$0.05
Output $ / M tokens—$0.33
Results tracked1818

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemma 3n E4b IT leads

Gemma 3n E4b IT: 37.0 (#198), Llama 3.2 3B: 27.6 (#319)

Coding benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
LMArena Coding12681098
BigCodeBench Instruct—23.4%
BigCodeBench Complete—28.3%

Agentic & Tool Use Not comparable

Gemma 3n E4b IT: —, Llama 3.2 3B: 20.1 (#143)

Agentic & Tool Use benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
Berkeley Function Calling Leaderboard—21.9%
BALROG—10.1%

Reasoning Llama 3.2 3B leads

Gemma 3n E4b IT: 19.9 (#247), Llama 3.2 3B: 21.0 (#228)

Reasoning benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
LMArena Hard Prompts12841095
Kagi LLM Benchmark31.5%—

Math Gemma 3n E4b IT leads

Gemma 3n E4b IT: 35.1 (#188), Llama 3.2 3B: 32.4 (#214)

Math benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
LMArena Math12511126

Knowledge Gemma 3n E4b IT leads

Gemma 3n E4b IT: 34.2 (#198), Llama 3.2 3B: 29.7 (#235)

Knowledge benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
LMArena Expert12461090

Multilingual Gemma 3n E4b IT leads

Gemma 3n E4b IT: 43.4 (#183), Llama 3.2 3B: 26.2 (#281)

Multilingual benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
LMArena Non-English12851019
LMArena Chinese13091017
LMArena German13111056
LMArena Russian1288949
LMArena French1330—
LMArena Japanese1272—
LMArena Korean1259—
LMArena Spanish1305—

Instruction Following Gemma 3n E4b IT leads

Gemma 3n E4b IT: 66.1 (#210), Llama 3.2 3B: 56.0 (#275)

Instruction Following benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
LMArena Instruction Following12551089

Long Context Gemma 3n E4b IT leads

Gemma 3n E4b IT: 38.7 (#191), Llama 3.2 3B: 33.4 (#261)

Long Context benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
LMArena Longer Query12761100

Writing & Preference Gemma 3n E4b IT leads

Gemma 3n E4b IT: 50.1 (#186), Llama 3.2 3B: 24.7 (#307)

Writing & Preference benchmarks
BenchmarkGemma 3n E4b ITLlama 3.2 3B
LMArena Text13061110
LMArena Creative Writing12871094
LMArena Multi-Turn12761105
EQ-Bench Creative Writing—595

Frequently asked questions

Is Gemma 3n E4b IT better than Llama 3.2 3B?

Gemma 3n E4b IT is the stronger model overall, scoring 37.3 to 28.9 on the Noometry Index.

Is Gemma 3n E4b IT or Llama 3.2 3B better for coding?

Gemma 3n E4b IT scores higher on coding benchmarks: 37.0 versus 27.6 in the Noometry coding category.

How many benchmarks do Gemma 3n E4b IT and Llama 3.2 3B share?

13 benchmarks have published results for both models. Gemma 3n E4b IT has 18 scored results on Noometry and Llama 3.2 3B has 18.

Related comparisons

Go deeper