Model comparison

Gemini 1.0 Pro vs Trinity Large Thinking

Trinity Large Thinking is the stronger model overall, scoring 38.6 to 27.3 on the Noometry Index.

Last verified . 16 shared benchmarks.

Gemini 1.0 Pro Google

27.3

Rank #332 Confirmed

Trinity Large Thinking Arcee AI

38.6

Rank #185 Confirmed

Summary

  • They share 16 benchmarks with published results for both. Gemini 1.0 Pro scores higher in 1 category and Trinity Large Thinking in 7 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in math, where Trinity Large Thinking leads 37.6 to 9.3.
  • Trinity Large Thinking has downloadable open weights; the other is API-only.

Side by side

Gemini 1.0 Pro and Trinity Large Thinking specifications
Gemini 1.0 ProTrinity Large Thinking
ProviderGoogleArcee AI
Noometry Index27.338.6
Released2023-12-132026-04-01
WeightsProprietaryOpen
Context window—262K
Max output—80K
Input $ / M tokens—$0.25
Output $ / M tokens—$0.80
Results tracked2424

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Trinity Large Thinking leads

Gemini 1.0 Pro: 32.2 (#275), Trinity Large Thinking: 34.1 (#244)

Coding benchmarks
BenchmarkGemini 1.0 ProTrinity Large Thinking
LMArena Coding11081381
LMArena WebDev—1238
SciCode—36.1%
HumanEval+55.5%—
MBPP+61.4%—

Reasoning Too close to call

Gemini 1.0 Pro: 17.1 (#296), Trinity Large Thinking: 16.9 (#298)

Reasoning benchmarks
BenchmarkGemini 1.0 ProTrinity Large Thinking
LMArena Hard Prompts11091350
NYT Connections (extended)—16.5%
CritPt—0.9%
Thematic Generalization—41.6%
DTBench45.9%—
Surface Evolver Bench—15.6%
Epoch Capabilities Index117.04—

Math Trinity Large Thinking leads

Gemini 1.0 Pro: 9.3 (#321), Trinity Large Thinking: 37.6 (#149)

Math benchmarks
BenchmarkGemini 1.0 ProTrinity Large Thinking
LMArena Math11321366
OTIS Mock AIME 2024-20251.1%—
MATH Level 511.2%—

Knowledge Trinity Large Thinking leads

Gemini 1.0 Pro: 15.6 (#291), Trinity Large Thinking: 40.9 (#113)

Knowledge benchmarks
BenchmarkGemini 1.0 ProTrinity Large Thinking
LMArena Expert10591360
GPQA Diamond34%—
Vectara Hallucination Rate—6.9%
MMLU70%—

Multilingual Trinity Large Thinking leads

Gemini 1.0 Pro: 33.4 (#252), Trinity Large Thinking: 46.2 (#160)

Multilingual benchmarks
BenchmarkGemini 1.0 ProTrinity Large Thinking
LMArena Non-English11381325
LMArena Chinese11241373
LMArena French11451374
LMArena German11251356
LMArena Japanese10231311
LMArena Russian11861337
LMArena Spanish11191357
LMArena Korean—1306

Instruction Following Trinity Large Thinking leads

Gemini 1.0 Pro: 57.6 (#267), Trinity Large Thinking: 70.5 (#162)

Instruction Following benchmarks
BenchmarkGemini 1.0 ProTrinity Large Thinking
LMArena Instruction Following11141334

Long Context Trinity Large Thinking leads

Gemini 1.0 Pro: 34.3 (#249), Trinity Large Thinking: 41.3 (#144)

Long Context benchmarks
BenchmarkGemini 1.0 ProTrinity Large Thinking
LMArena Longer Query11321355

Writing & Preference Trinity Large Thinking leads

Gemini 1.0 Pro: 36.0 (#264), Trinity Large Thinking: 53.8 (#158)

Writing & Preference benchmarks
BenchmarkGemini 1.0 ProTrinity Large Thinking
LMArena Text11491340
LMArena Creative Writing11311320
LMArena Multi-Turn11391342

Frequently asked questions

Is Gemini 1.0 Pro better than Trinity Large Thinking?

Trinity Large Thinking is the stronger model overall, scoring 38.6 to 27.3 on the Noometry Index.

Is Gemini 1.0 Pro or Trinity Large Thinking better for coding?

Trinity Large Thinking scores higher on coding benchmarks: 34.1 versus 32.2 in the Noometry coding category.

How many benchmarks do Gemini 1.0 Pro and Trinity Large Thinking share?

16 benchmarks have published results for both models. Gemini 1.0 Pro has 24 scored results on Noometry and Trinity Large Thinking has 24.

Related comparisons

Go deeper