Model comparison

Amazon Nova Experimental Chat 10 20 vs Claude Sonnet 5.5

Claude Sonnet 5.5 is the stronger model overall, scoring 61.9 to 42.1 on the Noometry Index.

Last verified . 12 shared benchmarks.

Claude Sonnet 5.5 Anthropic

61.9

Rank #10 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 10 20 scores higher in 0 categories and Claude Sonnet 5.5 in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Claude Sonnet 5.5 leads 87.9 to 39.0.

Side by side

Amazon Nova Experimental Chat 10 20 and Claude Sonnet 5.5 specifications
Amazon Nova Experimental Chat 10 20Claude Sonnet 5.5
ProviderAmazonAnthropic
Noometry Index42.161.9
Released—2026-09-28
WeightsProprietaryProprietary
Context window—1M
Max output—128K
Input $ / M tokens—$2
Output $ / M tokens—$10
Results tracked1732

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude Sonnet 5.5 leads

Amazon Nova Experimental Chat 10 20: 41.6 (#123), Claude Sonnet 5.5: 67.3 (#6)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Coding14121513
FrontierCode—52.1%
CursorBench—55.5%
LMArena WebDev—1774
FrontierSWE—61.9%
SciCode—61%
ALE-Bench—1,819

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 10 20: —, Claude Sonnet 5.5: 45.0 (#16)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
APEX-Agents—75.5%

Reasoning Claude Sonnet 5.5 leads

Amazon Nova Experimental Chat 10 20: 28.4 (#106), Claude Sonnet 5.5: 54.0 (#28)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Hard Prompts13961495
NYT Connections (extended)—80.5%
CritPt—31.4%
Mystery Game Puzzles—65%
Epoch Capabilities Index—165.03

Math Claude Sonnet 5.5 leads

Amazon Nova Experimental Chat 10 20: 39.0 (#119), Claude Sonnet 5.5: 87.9 (#6)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Math14251510
FrontierMath (Tiers 1-3)—88.8%
FrontierMath Tier 4—80.5%
OTIS Mock AIME 2024-2025—100%
ProofBench—100%
FrontierMath Erdős—2.9%

Knowledge Claude Sonnet 5.5 leads

Amazon Nova Experimental Chat 10 20: 38.5 (#144), Claude Sonnet 5.5: 66.0 (#12)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Expert13861540
GPQA Diamond—95.6%
SimpleQA Verified—46.5%

Multimodal Not comparable

Amazon Nova Experimental Chat 10 20: —, Claude Sonnet 5.5: 51.5 (#6)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Vision—1289
Furniture Assembly—75%

Multilingual Claude Sonnet 5.5 leads

Amazon Nova Experimental Chat 10 20: 49.5 (#131), Claude Sonnet 5.5: 55.3 (#30)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Non-English13721452
LMArena Chinese14041522
LMArena Russian13711451
LMArena French1425—
LMArena German1391—
LMArena Japanese1360—
LMArena Korean1324—
LMArena Spanish1382—

Instruction Following Claude Sonnet 5.5 leads

Amazon Nova Experimental Chat 10 20: 72.1 (#141), Claude Sonnet 5.5: 78.3 (#11)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Instruction Following13651495

Long Context Claude Sonnet 5.5 leads

Amazon Nova Experimental Chat 10 20: 41.7 (#133), Claude Sonnet 5.5: 45.9 (#28)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Longer Query13701498

Writing & Preference Claude Sonnet 5.5 leads

Amazon Nova Experimental Chat 10 20: 56.6 (#136), Claude Sonnet 5.5: 66.0 (#40)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 10 20Claude Sonnet 5.5
LMArena Text13941471
LMArena Creative Writing13181465
LMArena Multi-Turn13641474

Frequently asked questions

Is Amazon Nova Experimental Chat 10 20 better than Claude Sonnet 5.5?

Claude Sonnet 5.5 is the stronger model overall, scoring 61.9 to 42.1 on the Noometry Index.

Is Amazon Nova Experimental Chat 10 20 or Claude Sonnet 5.5 better for coding?

Claude Sonnet 5.5 scores higher on coding benchmarks: 67.3 versus 41.6 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 10 20 and Claude Sonnet 5.5 share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 10 20 has 17 scored results on Noometry and Claude Sonnet 5.5 has 32.

Related comparisons

Go deeper