Model comparison

Gemma 1.1 7b IT vs Qwen1.5 4b Chat

Gemma 1.1 7b IT is the stronger model overall, scoring 31.3 to 28.8 on the Noometry Index.

Last verified . 13 shared benchmarks.

Gemma 1.1 7b IT Google

31.3

Rank #277 Confirmed

Qwen1.5 4b Chat Alibaba (Qwen)

28.8

Rank #322 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Gemma 1.1 7b IT scores higher in 8 categories and Qwen1.5 4b Chat in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Gemma 1.1 7b IT leads 30.4 to 23.8.

Side by side

Gemma 1.1 7b IT and Qwen1.5 4b Chat specifications
Gemma 1.1 7b ITQwen1.5 4b Chat
ProviderGoogleAlibaba (Qwen)
Noometry Index31.328.8
Released——
WeightsOpenOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked1913

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 31.5 (#284), Qwen1.5 4b Chat: 29.1 (#308)

Coding benchmarks
BenchmarkGemma 1.1 7b ITQwen1.5 4b Chat
LMArena Coding1084999
HumanEval+35.4%—
MBPP+45%—

Reasoning Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 20.5 (#238), Qwen1.5 4b Chat: 18.5 (#279)

Reasoning benchmarks
BenchmarkGemma 1.1 7b ITQwen1.5 4b Chat
LMArena Hard Prompts1071976

Math Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 32.0 (#220), Qwen1.5 4b Chat: 30.4 (#234)

Math benchmarks
BenchmarkGemma 1.1 7b ITQwen1.5 4b Chat
LMArena Math11071026

Knowledge Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 28.3 (#247), Qwen1.5 4b Chat: 26.7 (#255)

Knowledge benchmarks
BenchmarkGemma 1.1 7b ITQwen1.5 4b Chat
LMArena Expert1039980

Multilingual Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 28.1 (#273), Qwen1.5 4b Chat: 24.1 (#290)

Multilingual benchmarks
BenchmarkGemma 1.1 7b ITQwen1.5 4b Chat
LMArena Non-English1052979
LMArena Chinese10611024
LMArena German1054902
LMArena Russian1046952
LMArena French1065—
LMArena Japanese971—
LMArena Korean988—
LMArena Spanish1049—

Instruction Following Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 54.0 (#283), Qwen1.5 4b Chat: 49.0 (#300)

Instruction Following benchmarks
BenchmarkGemma 1.1 7b ITQwen1.5 4b Chat
LMArena Instruction Following1057978

Long Context Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 32.1 (#272), Qwen1.5 4b Chat: 30.1 (#290)

Long Context benchmarks
BenchmarkGemma 1.1 7b ITQwen1.5 4b Chat
LMArena Longer Query1056988

Writing & Preference Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 30.4 (#288), Qwen1.5 4b Chat: 23.8 (#309)

Writing & Preference benchmarks
BenchmarkGemma 1.1 7b ITQwen1.5 4b Chat
LMArena Text1094997
LMArena Creative Writing1060969
LMArena Multi-Turn1040977

Frequently asked questions

Is Gemma 1.1 7b IT better than Qwen1.5 4b Chat?

Gemma 1.1 7b IT is the stronger model overall, scoring 31.3 to 28.8 on the Noometry Index.

Is Gemma 1.1 7b IT or Qwen1.5 4b Chat better for coding?

Gemma 1.1 7b IT scores higher on coding benchmarks: 31.5 versus 29.1 in the Noometry coding category.

How many benchmarks do Gemma 1.1 7b IT and Qwen1.5 4b Chat share?

13 benchmarks have published results for both models. Gemma 1.1 7b IT has 19 scored results on Noometry and Qwen1.5 4b Chat has 13.

Related comparisons

Go deeper