Model comparison

Gemini 3.1 Flash Lite vs Granite 4.0 H Small

Gemini 3.1 Flash Lite is the stronger model overall, scoring 40.8 to 36.5 on the Noometry Index.

Last verified . 14 shared benchmarks.

Gemini 3.1 Flash Lite Google

40.8

Rank #144 Confirmed

Granite 4.0 H Small IBM

36.5

Rank #214 Confirmed

Summary

  • They share 14 benchmarks with published results for both. Gemini 3.1 Flash Lite scores higher in 7 categories and Granite 4.0 H Small in 1 category; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Gemini 3.1 Flash Lite leads 60.9 to 43.8.
  • Granite 4.0 H Small has downloadable open weights; the other is API-only.

Side by side

Gemini 3.1 Flash Lite and Granite 4.0 H Small specifications
Gemini 3.1 Flash LiteGranite 4.0 H Small
ProviderGoogleIBM
Noometry Index40.836.5
Released2026-03-03—
WeightsProprietaryOpen
Context window1.05M—
Max output66K—
Input $ / M tokens$0.25—
Output $ / M tokens$1.50—
Results tracked3819

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 37.8 (#188), Granite 4.0 H Small: 36.4 (#209)

Coding benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
LMArena Coding14001249
LMArena WebDev1256—
SciCode41.9%—
WeirdML52.2%—
ALE-Bench797.73—

Agentic & Tool Use Not comparable

Gemini 3.1 Flash Lite: 30.2 (#79), Granite 4.0 H Small: —

Agentic & Tool Use benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
DeepResearch Bench37.3%—

Reasoning Granite 4.0 H Small leads

Gemini 3.1 Flash Lite: 22.9 (#186), Granite 4.0 H Small: 24.4 (#163)

Reasoning benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
LMArena Hard Prompts14071240
Kagi LLM Benchmark67.2%—
NYT Connections (extended)8.2%—
CritPt1.1%—
Chess Puzzles25%—
EnigmaEval3%—
Thematic Generalization63.3%—
DTBench76.8%—
LMCA35%—
Epoch Capabilities Index144.47—
ForecastBench54.4—

Math Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 40.7 (#90), Granite 4.0 H Small: 31.4 (#223)

Math benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
LMArena Math14281247
FrontierMath (Tiers 1-3)27.7%—
OTIS Mock AIME 2024-202580%—
Omni-MATH—29.6%

Knowledge Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 41.9 (#104), Granite 4.0 H Small: 32.0 (#215)

Knowledge benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
Vectara Hallucination Rate8.2%5.2%
LMArena Expert13981251
GPQA Diamond81.8%—
Humanity's Last Exam8.6%—
MMLU-Pro—56.9%
GPQA (HELM)—38.3%

Multimodal Not comparable

Gemini 3.1 Flash Lite: 39.4 (#60), Granite 4.0 H Small: —

Multimodal benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
LMArena Vision1240—

Multilingual Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 52.3 (#86), Granite 4.0 H Small: 38.6 (#228)

Multilingual benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
LMArena Non-English14111216
LMArena Chinese14611249
LMArena Russian14201201
LMArena Spanish14211258
LMArena French1424—
LMArena German1429—
LMArena Japanese1413—
LMArena Korean1392—

Instruction Following Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 72.7 (#131), Granite 4.0 H Small: 68.7 (#183)

Instruction Following benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
LMArena Instruction Following13771222
IFEval—89%

Long Context Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 42.5 (#122), Granite 4.0 H Small: 37.7 (#213)

Long Context benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
LMArena Longer Query13941242

Writing & Preference Gemini 3.1 Flash Lite leads

Gemini 3.1 Flash Lite: 60.9 (#94), Granite 4.0 H Small: 43.8 (#227)

Writing & Preference benchmarks
BenchmarkGemini 3.1 Flash LiteGranite 4.0 H Small
LMArena Text14161241
LMArena Creative Writing14011211
LMArena Multi-Turn14171242
WildBench—73.9%

Frequently asked questions

Is Gemini 3.1 Flash Lite better than Granite 4.0 H Small?

Gemini 3.1 Flash Lite is the stronger model overall, scoring 40.8 to 36.5 on the Noometry Index.

Is Gemini 3.1 Flash Lite or Granite 4.0 H Small better for coding?

Gemini 3.1 Flash Lite scores higher on coding benchmarks: 37.8 versus 36.4 in the Noometry coding category.

How many benchmarks do Gemini 3.1 Flash Lite and Granite 4.0 H Small share?

14 benchmarks have published results for both models. Gemini 3.1 Flash Lite has 38 scored results on Noometry and Granite 4.0 H Small has 19.

Related comparisons

Go deeper