Model comparison

Gemini 1.5 Pro (May 2024) vs Gemma 3n E4b IT

Gemma 3n E4b IT is the stronger model overall, scoring 37.3 to 32.1 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini 1.5 Pro (May 2024) Google

32.1

Rank #261 Confirmed

Gemma 3n E4b IT Google

37.3

Rank #206 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Gemini 1.5 Pro (May 2024) scores higher in 4 categories and Gemma 3n E4b IT in 4 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Gemma 3n E4b IT leads 35.1 to 25.8.
  • Gemma 3n E4b IT has downloadable open weights; the other is API-only.

Side by side

Gemini 1.5 Pro (May 2024) and Gemma 3n E4b IT specifications
Gemini 1.5 Pro (May 2024)Gemma 3n E4b IT
ProviderGoogleGoogle
Noometry Index32.137.3
Released2024-02-15—
WeightsProprietaryOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked4518

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemma 3n E4b IT leads

Gemini 1.5 Pro (May 2024): 34.2 (#241), Gemma 3n E4b IT: 37.0 (#198)

Coding benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Coding12941268
WeirdML22.2%—
BigCodeBench Instruct43.8%—
BigCodeBench Complete57.5%—
CadEval34%—
HumanEval+79.3%—
MBPP+74.6%—

Agentic & Tool Use Not comparable

Gemini 1.5 Pro (May 2024): 17.9 (#145), Gemma 3n E4b IT: —

Agentic & Tool Use benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
TheAgentCompany3.4%—
Cybench7.5%—
BALROG21%—

Reasoning Gemma 3n E4b IT leads

Gemini 1.5 Pro (May 2024): 12.3 (#338), Gemma 3n E4b IT: 19.9 (#247)

Reasoning benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Hard Prompts12961284
ARC-AGI-20.8%—
SimpleBench27.1%—
Kagi LLM Benchmark—31.5%
DTBench59%—
BIG-Bench Hard89.2%—
Epoch Capabilities Index131.73—
ForecastBench58.4—

Math Gemma 3n E4b IT leads

Gemini 1.5 Pro (May 2024): 25.8 (#266), Gemma 3n E4b IT: 35.1 (#188)

Math benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Math13151251
OTIS Mock AIME 2024-202523.1%—
Omni-MATH36.4%—
MATH Level 570.4%—

Knowledge Gemma 3n E4b IT leads

Gemini 1.5 Pro (May 2024): 29.4 (#239), Gemma 3n E4b IT: 34.2 (#198)

Knowledge benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Expert12791246
GPQA Diamond57.2%—
Humanity's Last Exam4.6%—
MMLU-Pro73.7%—
Confabulations13.5%—
GPQA (HELM)53.4%—
MMLU86.9%—

Multimodal Not comparable

Gemini 1.5 Pro (May 2024): 36.8 (#77), Gemma 3n E4b IT: —

Multimodal benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Vision1161—
Video-MME75%—

Multilingual Gemini 1.5 Pro (May 2024) leads

Gemini 1.5 Pro (May 2024): 45.3 (#174), Gemma 3n E4b IT: 43.4 (#183)

Multilingual benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Non-English13121285
LMArena Chinese13311309
LMArena French13021330
LMArena German12861311
LMArena Japanese12921272
LMArena Korean12981259
LMArena Russian13201288
LMArena Spanish13111305

Instruction Following Gemini 1.5 Pro (May 2024) leads

Gemini 1.5 Pro (May 2024): 68.6 (#185), Gemma 3n E4b IT: 66.1 (#210)

Instruction Following benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Instruction Following12971255
IFEval83.7%—

Long Context Gemini 1.5 Pro (May 2024) leads

Gemini 1.5 Pro (May 2024): 39.8 (#169), Gemma 3n E4b IT: 38.7 (#191)

Long Context benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Longer Query13081276

Writing & Preference Gemini 1.5 Pro (May 2024) leads

Gemini 1.5 Pro (May 2024): 52.4 (#172), Gemma 3n E4b IT: 50.1 (#186)

Writing & Preference benchmarks
BenchmarkGemini 1.5 Pro (May 2024)Gemma 3n E4b IT
LMArena Text13191306
LMArena Creative Writing13331287
LMArena Multi-Turn12961276
WildBench81.3%—

Frequently asked questions

Is Gemini 1.5 Pro (May 2024) better than Gemma 3n E4b IT?

Gemma 3n E4b IT is the stronger model overall, scoring 37.3 to 32.1 on the Noometry Index.

Is Gemini 1.5 Pro (May 2024) or Gemma 3n E4b IT better for coding?

Gemma 3n E4b IT scores higher on coding benchmarks: 37.0 versus 34.2 in the Noometry coding category.

How many benchmarks do Gemini 1.5 Pro (May 2024) and Gemma 3n E4b IT share?

17 benchmarks have published results for both models. Gemini 1.5 Pro (May 2024) has 45 scored results on Noometry and Gemma 3n E4b IT has 18.

Related comparisons

Go deeper