Model comparison

Gemma 1.1 7b IT vs Trinity Large Thinking

Trinity Large Thinking is the stronger model overall, scoring 38.6 to 31.3 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemma 1.1 7b IT Google

31.3

Rank #277 Confirmed

Trinity Large Thinking Arcee AI

38.6

Rank #185 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Gemma 1.1 7b IT scores higher in 1 category and Trinity Large Thinking in 7 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Trinity Large Thinking leads 53.8 to 30.4.

Side by side

Gemma 1.1 7b IT and Trinity Large Thinking specifications
Gemma 1.1 7b ITTrinity Large Thinking
ProviderGoogleArcee AI
Noometry Index31.338.6
Released—2026-04-01
WeightsOpenOpen
Context window—262K
Max output—80K
Input $ / M tokens—$0.25
Output $ / M tokens—$0.80
Results tracked1924

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Trinity Large Thinking leads

Gemma 1.1 7b IT: 31.5 (#284), Trinity Large Thinking: 34.1 (#244)

Coding benchmarks
BenchmarkGemma 1.1 7b ITTrinity Large Thinking
LMArena Coding10841381
LMArena WebDev—1238
SciCode—36.1%
HumanEval+35.4%—
MBPP+45%—

Reasoning Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 20.5 (#238), Trinity Large Thinking: 16.9 (#298)

Reasoning benchmarks
BenchmarkGemma 1.1 7b ITTrinity Large Thinking
LMArena Hard Prompts10711350
NYT Connections (extended)—16.5%
CritPt—0.9%
Thematic Generalization—41.6%
Surface Evolver Bench—15.6%

Math Trinity Large Thinking leads

Gemma 1.1 7b IT: 32.0 (#220), Trinity Large Thinking: 37.6 (#149)

Math benchmarks
BenchmarkGemma 1.1 7b ITTrinity Large Thinking
LMArena Math11071366

Knowledge Trinity Large Thinking leads

Gemma 1.1 7b IT: 28.3 (#247), Trinity Large Thinking: 40.9 (#113)

Knowledge benchmarks
BenchmarkGemma 1.1 7b ITTrinity Large Thinking
LMArena Expert10391360
Vectara Hallucination Rate—6.9%

Multilingual Trinity Large Thinking leads

Gemma 1.1 7b IT: 28.1 (#273), Trinity Large Thinking: 46.2 (#160)

Multilingual benchmarks
BenchmarkGemma 1.1 7b ITTrinity Large Thinking
LMArena Non-English10521325
LMArena Chinese10611373
LMArena French10651374
LMArena German10541356
LMArena Japanese9711311
LMArena Korean9881306
LMArena Russian10461337
LMArena Spanish10491357

Instruction Following Trinity Large Thinking leads

Gemma 1.1 7b IT: 54.0 (#283), Trinity Large Thinking: 70.5 (#162)

Instruction Following benchmarks
BenchmarkGemma 1.1 7b ITTrinity Large Thinking
LMArena Instruction Following10571334

Long Context Trinity Large Thinking leads

Gemma 1.1 7b IT: 32.1 (#272), Trinity Large Thinking: 41.3 (#144)

Long Context benchmarks
BenchmarkGemma 1.1 7b ITTrinity Large Thinking
LMArena Longer Query10561355

Writing & Preference Trinity Large Thinking leads

Gemma 1.1 7b IT: 30.4 (#288), Trinity Large Thinking: 53.8 (#158)

Writing & Preference benchmarks
BenchmarkGemma 1.1 7b ITTrinity Large Thinking
LMArena Text10941340
LMArena Creative Writing10601320
LMArena Multi-Turn10401342

Frequently asked questions

Is Gemma 1.1 7b IT better than Trinity Large Thinking?

Trinity Large Thinking is the stronger model overall, scoring 38.6 to 31.3 on the Noometry Index.

Is Gemma 1.1 7b IT or Trinity Large Thinking better for coding?

Trinity Large Thinking scores higher on coding benchmarks: 34.1 versus 31.5 in the Noometry coding category.

How many benchmarks do Gemma 1.1 7b IT and Trinity Large Thinking share?

17 benchmarks have published results for both models. Gemma 1.1 7b IT has 19 scored results on Noometry and Trinity Large Thinking has 24.

Related comparisons

Go deeper