Model comparison

Amazon Nova Pro vs Claude 3.7 Sonnet

Claude 3.7 Sonnet is the stronger model overall, scoring 39.5 to 31.0 on the Noometry Index.

Last verified . 35 shared benchmarks.

Amazon Nova Pro Amazon

31.0

Rank #281 Confirmed

Claude 3.7 Sonnet Anthropic

39.5

Rank #164 Confirmed

Summary

  • They share 35 benchmarks with published results for both. Amazon Nova Pro scores higher in 1 category and Claude 3.7 Sonnet in 9 categories; 10 gaps are clear of the uncertainty.
  • The widest gap is in agentic & tool use, where Claude 3.7 Sonnet leads 34.1 to 16.7.
  • The biggest single-benchmark swing is LiveBench Reasoning: 32.6% for Amazon Nova Pro and 87.8% for Claude 3.7 Sonnet.

Side by side

Amazon Nova Pro and Claude 3.7 Sonnet specifications
Amazon Nova ProClaude 3.7 Sonnet
ProviderAmazonAnthropic
Noometry Index31.039.5
Released2024-12-032025-02-24
WeightsProprietaryProprietary
Context window300K—
Max output10K—
Input $ / M tokens$0.80—
Output $ / M tokens$3.20—
Results tracked3858

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude 3.7 Sonnet leads

Amazon Nova Pro: 35.1 (#229), Claude 3.7 Sonnet: 40.6 (#136)

Coding benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
LiveBench Coding38.1%74.5%
LMArena Coding12701361
SWE-bench Verified—61%
SWE-bench Verified (bash only)—52.8%
Aider Polyglot—64.9%
GSO—3.8%
CadEval—54%

Agentic & Tool Use Claude 3.7 Sonnet leads

Amazon Nova Pro: 16.7 (#147), Claude 3.7 Sonnet: 34.1 (#50)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
TheAgentCompany1.7%30.9%
Berkeley Function Calling Leaderboard25%—
Cybench—20%
DeepResearch Bench—43.6%
OSWorld—35.8%
METR Time Horizons—60%

Reasoning Amazon Nova Pro leads

Amazon Nova Pro: 20.0 (#243), Claude 3.7 Sonnet: 18.6 (#277)

Reasoning benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
LiveBench Reasoning32.6%87.8%
LMArena Hard Prompts12461333
LiveBench Data Analysis48.3%74%
Epoch Capabilities Index123.8141.16
LiveBench43.5%76.1%
ARC-AGI-2—0.9%
SimpleBench—46.4%
ARC-AGI-1—28.6%
EnigmaEval—4.2%
ForecastBench—61.8

Math Claude 3.7 Sonnet leads

Amazon Nova Pro: 28.5 (#243), Claude 3.7 Sonnet: 37.5 (#153)

Math benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
Omni-MATH24.2%33%
LiveBench Math38%79%
LMArena Math12521337
OTIS Mock AIME 2024-2025—57.8%
MATH Level 5—91.2%
FrontierMath (Feb 2025 set)—4.1%

Knowledge Claude 3.7 Sonnet leads

Amazon Nova Pro: 27.4 (#250), Claude 3.7 Sonnet: 39.8 (#130)

Knowledge benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
Humanity's Last Exam4.4%8%
MMLU-Pro67.3%78.4%
Confabulations30.1%14.7%
GPQA (HELM)44.6%60.8%
LMArena Expert12111321
GPQA Diamond—79.7%
Vectara Hallucination Rate5.1%—
MMLU82%—

Multimodal Claude 3.7 Sonnet leads

Amazon Nova Pro: 25.0 (#126), Claude 3.7 Sonnet: 33.7 (#95)

Multimodal benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
LMArena Vision9801169
GeoBench—68%
VPCT—39%
SpatialViz-Bench—33.9%

Multilingual Claude 3.7 Sonnet leads

Amazon Nova Pro: 39.7 (#223), Claude 3.7 Sonnet: 44.1 (#179)

Multilingual benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
LMArena Non-English12341296
LMArena Chinese12441299
LMArena French12711303
LMArena German12431301
LMArena Japanese12001267
LMArena Korean12031249
LMArena Russian12401311
LMArena Spanish11821298

Instruction Following Claude 3.7 Sonnet leads

Amazon Nova Pro: 64.9 (#226), Claude 3.7 Sonnet: 72.9 (#125)

Instruction Following benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
LiveBench Instruction Following67.1%81.3%
IFEval81.5%83.4%
LMArena Instruction Following12351352

Long Context Claude 3.7 Sonnet leads

Amazon Nova Pro: 38.1 (#205), Claude 3.7 Sonnet: 50.3 (#10)

Long Context benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
LMArena Longer Query12551373
Fiction.LiveBench—83.3%

Writing & Preference Claude 3.7 Sonnet leads

Amazon Nova Pro: 43.9 (#226), Claude 3.7 Sonnet: 54.4 (#150)

Writing & Preference benchmarks
BenchmarkAmazon Nova ProClaude 3.7 Sonnet
LMArena Text12591314
LMArena Creative Writing12121332
Short-Story Creative Writing60.5%81.1%
WildBench77.7%81.4%
LMArena Multi-Turn12461339
LiveBench Language37%59.9%
EQ-Bench Creative Writing—1412

Frequently asked questions

Is Amazon Nova Pro better than Claude 3.7 Sonnet?

Claude 3.7 Sonnet is the stronger model overall, scoring 39.5 to 31.0 on the Noometry Index.

Is Amazon Nova Pro or Claude 3.7 Sonnet better for coding?

Claude 3.7 Sonnet scores higher on coding benchmarks: 40.6 versus 35.1 in the Noometry coding category.

How many benchmarks do Amazon Nova Pro and Claude 3.7 Sonnet share?

35 benchmarks have published results for both models. Amazon Nova Pro has 38 scored results on Noometry and Claude 3.7 Sonnet has 58.

Related comparisons

Go deeper