Model comparison

Solar Pro4 vs Trinity Large Thinking

Solar Pro4 is the stronger model overall, scoring 42.1 to 38.6 on the Noometry Index.

Last verified . 18 shared benchmarks.

Solar Pro4 Upstage

42.1

Rank #121 Confirmed

Trinity Large Thinking Arcee AI

38.6

Rank #185 Confirmed

Summary

  • They share 18 benchmarks with published results for both. Solar Pro4 scores higher in 7 categories and Trinity Large Thinking in 1 category; 7 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Solar Pro4 leads 28.5 to 16.9.
  • Trinity Large Thinking is cheaper at $0.25 / $0.80 per million input/output tokens, against $0.30 / $1.20 for Solar Pro4.
  • Solar Pro4 accepts more context: 524K tokens versus 262K.
  • Trinity Large Thinking has downloadable open weights; the other is API-only.

Side by side

Solar Pro4 and Trinity Large Thinking specifications
Solar Pro4Trinity Large Thinking
ProviderUpstageArcee AI
Noometry Index42.138.6
Released2026-08-062026-04-01
WeightsProprietaryOpen
Context window524K262K
Max output131K80K
Input $ / M tokens$0.30$0.25
Output $ / M tokens$1.20$0.80
Results tracked1824

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Solar Pro4 leads

Solar Pro4: 40.1 (#149), Trinity Large Thinking: 34.1 (#244)

Coding benchmarks
BenchmarkSolar Pro4Trinity Large Thinking
LMArena WebDev13711238
LMArena Coding14371381
SciCode—36.1%

Reasoning Solar Pro4 leads

Solar Pro4: 28.5 (#104), Trinity Large Thinking: 16.9 (#298)

Reasoning benchmarks
BenchmarkSolar Pro4Trinity Large Thinking
LMArena Hard Prompts13991350
NYT Connections (extended)—16.5%
CritPt—0.9%
Thematic Generalization—41.6%
Surface Evolver Bench—15.6%

Math Solar Pro4 leads

Solar Pro4: 38.8 (#128), Trinity Large Thinking: 37.6 (#149)

Math benchmarks
BenchmarkSolar Pro4Trinity Large Thinking
LMArena Math14161366

Knowledge Trinity Large Thinking leads

Solar Pro4: 39.8 (#129), Trinity Large Thinking: 40.9 (#113)

Knowledge benchmarks
BenchmarkSolar Pro4Trinity Large Thinking
LMArena Expert14271360
Vectara Hallucination Rate—6.9%

Multilingual Solar Pro4 leads

Solar Pro4: 48.7 (#139), Trinity Large Thinking: 46.2 (#160)

Multilingual benchmarks
BenchmarkSolar Pro4Trinity Large Thinking
LMArena Non-English13611325
LMArena Chinese14151373
LMArena French13971374
LMArena German13641356
LMArena Japanese13091311
LMArena Korean13821306
LMArena Russian13601337
LMArena Spanish14011357

Instruction Following Solar Pro4 leads

Solar Pro4: 72.7 (#132), Trinity Large Thinking: 70.5 (#162)

Instruction Following benchmarks
BenchmarkSolar Pro4Trinity Large Thinking
LMArena Instruction Following13771334

Long Context Too close to call

Solar Pro4: 42.1 (#130), Trinity Large Thinking: 41.3 (#144)

Long Context benchmarks
BenchmarkSolar Pro4Trinity Large Thinking
LMArena Longer Query13811355

Writing & Preference Solar Pro4 leads

Solar Pro4: 56.5 (#138), Trinity Large Thinking: 53.8 (#158)

Writing & Preference benchmarks
BenchmarkSolar Pro4Trinity Large Thinking
LMArena Text13861340
LMArena Creative Writing13161320
LMArena Multi-Turn13851342

Frequently asked questions

Is Solar Pro4 better than Trinity Large Thinking?

Solar Pro4 is the stronger model overall, scoring 42.1 to 38.6 on the Noometry Index.

Which is cheaper, Solar Pro4 or Trinity Large Thinking?

Trinity Large Thinking is cheaper. It lists at $0.25 per million input tokens and $0.80 per million output tokens; Solar Pro4 lists at $0.30 and $1.20.

Is Solar Pro4 or Trinity Large Thinking better for coding?

Solar Pro4 scores higher on coding benchmarks: 40.1 versus 34.1 in the Noometry coding category.

Which has the bigger context window?

Solar Pro4 does, with 524K tokens against 262K.

How many benchmarks do Solar Pro4 and Trinity Large Thinking share?

18 benchmarks have published results for both models. Solar Pro4 has 18 scored results on Noometry and Trinity Large Thinking has 24.

Related comparisons

Go deeper