Model comparison

Gemma 1.1 7b IT vs Mixtral 8x22B

Gemma 1.1 7b IT is the stronger model overall, scoring 31.3 to 27.1 on the Noometry Index.

Last verified . 19 shared benchmarks.

Gemma 1.1 7b IT Google

31.3

Rank #277 Confirmed

Mixtral 8x22B Mistral AI

27.1

Rank #333 Confirmed

Summary

  • They share 19 benchmarks with published results for both. Gemma 1.1 7b IT scores higher in 4 categories and Mixtral 8x22B in 4 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Gemma 1.1 7b IT leads 28.3 to 15.1.

Side by side

Gemma 1.1 7b IT and Mixtral 8x22B specifications
Gemma 1.1 7b ITMixtral 8x22B
ProviderGoogleMistral AI
Noometry Index31.327.1
Released—2024-04-17
WeightsOpenOpen
Context window—64K
Max output—64K
Input $ / M tokens—$2
Output $ / M tokens—$6
Results tracked1934

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 31.5 (#284), Mixtral 8x22B: 24.2 (#329)

Coding benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
LMArena Coding10841166
HumanEval+35.4%72%
MBPP+45%64.3%
WeirdML—3.2%
BigCodeBench Instruct—40.6%
BigCodeBench Complete—50.2%

Agentic & Tool Use Not comparable

Gemma 1.1 7b IT: —, Mixtral 8x22B: 23.1 (#127)

Agentic & Tool Use benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
Cybench—7.5%

Reasoning Too close to call

Gemma 1.1 7b IT: 20.5 (#238), Mixtral 8x22B: 19.9 (#248)

Reasoning benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
LMArena Hard Prompts10711150
DTBench—55.1%
Epoch Capabilities Index—122.03
ForecastBench—56.3

Math Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 32.0 (#220), Mixtral 8x22B: 22.9 (#275)

Math benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
LMArena Math11071184
Omni-MATH—16.3%
MATH Level 5—24.2%

Knowledge Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 28.3 (#247), Mixtral 8x22B: 15.1 (#293)

Knowledge benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
LMArena Expert10391113
GPQA Diamond—34.1%
MMLU-Pro—46%
GPQA (HELM)—33.4%
MMLU—77.8%

Multilingual Mixtral 8x22B leads

Gemma 1.1 7b IT: 28.1 (#273), Mixtral 8x22B: 32.8 (#255)

Multilingual benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
LMArena Non-English10521128
LMArena Chinese10611116
LMArena French10651166
LMArena German10541141
LMArena Japanese9711037
LMArena Korean9881057
LMArena Russian10461158
LMArena Spanish10491151

Instruction Following Mixtral 8x22B leads

Gemma 1.1 7b IT: 54.0 (#283), Mixtral 8x22B: 57.7 (#266)

Instruction Following benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
LMArena Instruction Following10571147
IFEval—72.4%

Long Context Mixtral 8x22B leads

Gemma 1.1 7b IT: 32.1 (#272), Mixtral 8x22B: 34.7 (#247)

Long Context benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
LMArena Longer Query10561144

Writing & Preference Mixtral 8x22B leads

Gemma 1.1 7b IT: 30.4 (#288), Mixtral 8x22B: 36.9 (#262)

Writing & Preference benchmarks
BenchmarkGemma 1.1 7b ITMixtral 8x22B
LMArena Text10941162
LMArena Creative Writing10601141
LMArena Multi-Turn10401130
WildBench—71.1%

Frequently asked questions

Is Gemma 1.1 7b IT better than Mixtral 8x22B?

Gemma 1.1 7b IT is the stronger model overall, scoring 31.3 to 27.1 on the Noometry Index.

Is Gemma 1.1 7b IT or Mixtral 8x22B better for coding?

Gemma 1.1 7b IT scores higher on coding benchmarks: 31.5 versus 24.2 in the Noometry coding category.

How many benchmarks do Gemma 1.1 7b IT and Mixtral 8x22B share?

19 benchmarks have published results for both models. Gemma 1.1 7b IT has 19 scored results on Noometry and Mixtral 8x22B has 34.

Related comparisons

Go deeper