Model comparison

Gemma 3n E4b IT vs Qwen3.5 27B

Qwen3.5 27B is the stronger model overall, scoring 41.9 to 37.3 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemma 3n E4b IT Google

37.3

Rank #206 Confirmed

Qwen3.5 27B Alibaba (Qwen)

41.9

Rank #127 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Gemma 3n E4b IT scores higher in 0 categories and Qwen3.5 27B in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Qwen3.5 27B leads 59.3 to 50.1.

Side by side

Gemma 3n E4b IT and Qwen3.5 27B specifications
Gemma 3n E4b ITQwen3.5 27B
ProviderGoogleAlibaba (Qwen)
Noometry Index37.341.9
Released—2026-02-23
WeightsOpenOpen
Context window—262K
Max output—66K
Input $ / M tokens—$0.30
Output $ / M tokens—$2.40
Results tracked1828

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Qwen3.5 27B leads

Gemma 3n E4b IT: 37.0 (#198), Qwen3.5 27B: 38.9 (#168)

Coding benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Coding12681427
LMArena WebDev—1358
WeirdML—39.5%
ALE-Bench—349.45

Agentic & Tool Use Not comparable

Gemma 3n E4b IT: —, Qwen3.5 27B: —

Agentic & Tool Use benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
Vending-Bench 2—201.98

Reasoning Qwen3.5 27B leads

Gemma 3n E4b IT: 19.9 (#247), Qwen3.5 27B: 27.5 (#117)

Reasoning benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Hard Prompts12841414
Kagi LLM Benchmark31.5%—
NYT Connections (extended)—47.9%
Thematic Generalization—45.5%
DTBench—82.4%
LMCA—34%

Math Qwen3.5 27B leads

Gemma 3n E4b IT: 35.1 (#188), Qwen3.5 27B: 38.8 (#127)

Math benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Math12511429
MathArena Final-Answer Competitions—56.7%

Knowledge Qwen3.5 27B leads

Gemma 3n E4b IT: 34.2 (#198), Qwen3.5 27B: 38.0 (#150)

Knowledge benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Expert12461428
Vectara Hallucination Rate—12.1%

Multimodal Not comparable

Gemma 3n E4b IT: —, Qwen3.5 27B: 39.4 (#59)

Multimodal benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Vision—1241

Multilingual Qwen3.5 27B leads

Gemma 3n E4b IT: 43.4 (#183), Qwen3.5 27B: 50.8 (#115)

Multilingual benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Non-English12851390
LMArena Chinese13091478
LMArena French13301410
LMArena German13111393
LMArena Japanese12721345
LMArena Korean12591358
LMArena Russian12881390
LMArena Spanish13051407

Instruction Following Qwen3.5 27B leads

Gemma 3n E4b IT: 66.1 (#210), Qwen3.5 27B: 73.5 (#119)

Instruction Following benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Instruction Following12551393

Long Context Qwen3.5 27B leads

Gemma 3n E4b IT: 38.7 (#191), Qwen3.5 27B: 43.1 (#106)

Long Context benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Longer Query12761413

Writing & Preference Qwen3.5 27B leads

Gemma 3n E4b IT: 50.1 (#186), Qwen3.5 27B: 59.3 (#111)

Writing & Preference benchmarks
BenchmarkGemma 3n E4b ITQwen3.5 27B
LMArena Text13061409
LMArena Creative Writing12871362
LMArena Multi-Turn12761410

Frequently asked questions

Is Gemma 3n E4b IT better than Qwen3.5 27B?

Qwen3.5 27B is the stronger model overall, scoring 41.9 to 37.3 on the Noometry Index.

Is Gemma 3n E4b IT or Qwen3.5 27B better for coding?

Qwen3.5 27B scores higher on coding benchmarks: 38.9 versus 37.0 in the Noometry coding category.

How many benchmarks do Gemma 3n E4b IT and Qwen3.5 27B share?

17 benchmarks have published results for both models. Gemma 3n E4b IT has 18 scored results on Noometry and Qwen3.5 27B has 28.

Related comparisons

Go deeper