Model comparison

Claude 3.5 Haiku vs Solar Pro4

Solar Pro4 is the stronger model overall, scoring 42.1 to 29.2 on the Noometry Index.

Last verified . 17 shared benchmarks.

Claude 3.5 Haiku Anthropic

29.2

Rank #315 Confirmed

Solar Pro4 Upstage

42.1

Rank #121 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Claude 3.5 Haiku scores higher in 0 categories and Solar Pro4 in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Solar Pro4 leads 38.8 to 14.7.

Side by side

Claude 3.5 Haiku and Solar Pro4 specifications
Claude 3.5 HaikuSolar Pro4
ProviderAnthropicUpstage
Noometry Index29.242.1
Released2024-10-222026-08-06
WeightsProprietaryProprietary
Context window—524K
Max output—131K
Input $ / M tokens—$0.30
Output $ / M tokens—$1.20
Results tracked4918

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Solar Pro4 leads

Claude 3.5 Haiku: 32.9 (#265), Solar Pro4: 40.1 (#149)

Coding benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Coding12861437
Aider Polyglot28%—
LMArena WebDev—1371
SciCode27.4%—
WeirdML30.7%—
BigCodeBench Instruct46.1%—
LiveBench Coding51.4%—
BigCodeBench Complete59%—
CadEval32%—

Agentic & Tool Use Not comparable

Claude 3.5 Haiku: 28.0 (#95), Solar Pro4: —

Agentic & Tool Use benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
BALROG19.3%—

Reasoning Solar Pro4 leads

Claude 3.5 Haiku: 17.7 (#290), Solar Pro4: 28.5 (#104)

Reasoning benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Hard Prompts12511399
CritPt0%—
LiveBench Reasoning28.1%—
DTBench56.7%—
LiveBench Data Analysis48.5%—
Epoch Capabilities Index127.15—
LiveBench43.5%—

Math Solar Pro4 leads

Claude 3.5 Haiku: 14.7 (#300), Solar Pro4: 38.8 (#128)

Math benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Math12441416
OTIS Mock AIME 2024-20254.3%—
Omni-MATH22.4%—
LiveBench Math35.5%—
MATH Level 546.4%—
FrontierMath (Feb 2025 set)0.3%—

Knowledge Solar Pro4 leads

Claude 3.5 Haiku: 18.7 (#281), Solar Pro4: 39.8 (#129)

Knowledge benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Expert12081427
GPQA Diamond38.1%—
MMLU-Pro60.5%—
Confabulations36.7%—
GPQA (HELM)36.3%—
MMLU74.3%—

Multimodal Not comparable

Claude 3.5 Haiku: 26.8 (#117), Solar Pro4: —

Multimodal benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Vision1092—
GeoBench34%—

Multilingual Solar Pro4 leads

Claude 3.5 Haiku: 40.0 (#218), Solar Pro4: 48.7 (#139)

Multilingual benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Non-English12381361
LMArena Chinese12291415
LMArena French12641397
LMArena German12371364
LMArena Japanese11751309
LMArena Korean11731382
LMArena Russian12531360
LMArena Spanish12611401

Instruction Following Solar Pro4 leads

Claude 3.5 Haiku: 62.9 (#234), Solar Pro4: 72.7 (#132)

Instruction Following benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Instruction Following12411377
LiveBench Instruction Following61.9%—
IFEval79.2%—

Long Context Solar Pro4 leads

Claude 3.5 Haiku: 38.3 (#200), Solar Pro4: 42.1 (#130)

Long Context benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Longer Query12611381

Writing & Preference Solar Pro4 leads

Claude 3.5 Haiku: 42.7 (#234), Solar Pro4: 56.5 (#138)

Writing & Preference benchmarks
BenchmarkClaude 3.5 HaikuSolar Pro4
LMArena Text12551386
LMArena Creative Writing12331316
LMArena Multi-Turn12651385
Short-Story Creative Writing73.5%—
EQ-Bench Creative Writing1146—
WildBench76%—
LiveBench Language35.4%—

Frequently asked questions

Is Claude 3.5 Haiku better than Solar Pro4?

Solar Pro4 is the stronger model overall, scoring 42.1 to 29.2 on the Noometry Index.

Is Claude 3.5 Haiku or Solar Pro4 better for coding?

Solar Pro4 scores higher on coding benchmarks: 40.1 versus 32.9 in the Noometry coding category.

How many benchmarks do Claude 3.5 Haiku and Solar Pro4 share?

17 benchmarks have published results for both models. Claude 3.5 Haiku has 49 scored results on Noometry and Solar Pro4 has 18.

Related comparisons

Go deeper