Model comparison

Claude 3.7 Sonnet vs Solar Pro4

Solar Pro4 is the stronger model overall, scoring 42.1 to 39.5 on the Noometry Index.

Last verified . 17 shared benchmarks.

Claude 3.7 Sonnet Anthropic

39.5

Rank #164 Confirmed

Solar Pro4 Upstage

42.1

Rank #121 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Claude 3.7 Sonnet scores higher in 3 categories and Solar Pro4 in 5 categories; 5 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Solar Pro4 leads 28.5 to 18.6.

Side by side

Claude 3.7 Sonnet and Solar Pro4 specifications
Claude 3.7 SonnetSolar Pro4
ProviderAnthropicUpstage
Noometry Index39.542.1
Released2025-02-242026-08-06
WeightsProprietaryProprietary
Context window—524K
Max output—131K
Input $ / M tokens—$0.30
Output $ / M tokens—$1.20
Results tracked5818

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Claude 3.7 Sonnet: 40.6 (#136), Solar Pro4: 40.1 (#149)

Coding benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Coding13611437
SWE-bench Verified61%—
SWE-bench Verified (bash only)52.8%—
Aider Polyglot64.9%—
LMArena WebDev—1371
GSO3.8%—
LiveBench Coding74.5%—
CadEval54%—

Agentic & Tool Use Not comparable

Claude 3.7 Sonnet: 34.1 (#50), Solar Pro4: —

Agentic & Tool Use benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
TheAgentCompany30.9%—
Cybench20%—
DeepResearch Bench43.6%—
OSWorld35.8%—
METR Time Horizons60%—

Reasoning Solar Pro4 leads

Claude 3.7 Sonnet: 18.6 (#277), Solar Pro4: 28.5 (#104)

Reasoning benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Hard Prompts13331399
ARC-AGI-20.9%—
SimpleBench46.4%—
ARC-AGI-128.6%—
EnigmaEval4.2%—
LiveBench Reasoning87.8%—
LiveBench Data Analysis74%—
Epoch Capabilities Index141.16—
ForecastBench61.8—
LiveBench76.1%—

Math Solar Pro4 leads

Claude 3.7 Sonnet: 37.5 (#153), Solar Pro4: 38.8 (#128)

Math benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Math13371416
OTIS Mock AIME 2024-202557.8%—
Omni-MATH33%—
LiveBench Math79%—
MATH Level 591.2%—
FrontierMath (Feb 2025 set)4.1%—

Knowledge Too close to call

Claude 3.7 Sonnet: 39.8 (#130), Solar Pro4: 39.8 (#129)

Knowledge benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Expert13211427
GPQA Diamond79.7%—
Humanity's Last Exam8%—
MMLU-Pro78.4%—
Confabulations14.7%—
GPQA (HELM)60.8%—

Multimodal Not comparable

Claude 3.7 Sonnet: 33.7 (#95), Solar Pro4: —

Multimodal benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Vision1169—
GeoBench68%—
VPCT39%—
SpatialViz-Bench33.9%—

Multilingual Solar Pro4 leads

Claude 3.7 Sonnet: 44.1 (#179), Solar Pro4: 48.7 (#139)

Multilingual benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Non-English12961361
LMArena Chinese12991415
LMArena French13031397
LMArena German13011364
LMArena Japanese12671309
LMArena Korean12491382
LMArena Russian13111360
LMArena Spanish12981401

Instruction Following Too close to call

Claude 3.7 Sonnet: 72.9 (#125), Solar Pro4: 72.7 (#132)

Instruction Following benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Instruction Following13521377
LiveBench Instruction Following81.3%—
IFEval83.4%—

Long Context Claude 3.7 Sonnet leads

Claude 3.7 Sonnet: 50.3 (#10), Solar Pro4: 42.1 (#130)

Long Context benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Longer Query13731381
Fiction.LiveBench83.3%—

Writing & Preference Solar Pro4 leads

Claude 3.7 Sonnet: 54.4 (#150), Solar Pro4: 56.5 (#138)

Writing & Preference benchmarks
BenchmarkClaude 3.7 SonnetSolar Pro4
LMArena Text13141386
LMArena Creative Writing13321316
LMArena Multi-Turn13391385
Short-Story Creative Writing81.1%—
EQ-Bench Creative Writing1412—
WildBench81.4%—
LiveBench Language59.9%—

Frequently asked questions

Is Claude 3.7 Sonnet better than Solar Pro4?

Solar Pro4 is the stronger model overall, scoring 42.1 to 39.5 on the Noometry Index.

Is Claude 3.7 Sonnet or Solar Pro4 better for coding?

They score almost the same on coding (40.6 vs 40.1); test both on your own repository before choosing.

How many benchmarks do Claude 3.7 Sonnet and Solar Pro4 share?

17 benchmarks have published results for both models. Claude 3.7 Sonnet has 58 scored results on Noometry and Solar Pro4 has 18.

Related comparisons

Go deeper