# Amazon Nova Micro vs Claude 3.7 Sonnet

> Claude 3.7 Sonnet is the stronger model overall, scoring 39.5 to 30.4 on the Noometry Index.

- Canonical page: https://noometry.com/compare/amazon-nova-micro-vs-claude-3-7-sonnet
- Last updated: 2026-10-11
- Shared benchmarks: 29

## Summary

- They share 29 benchmarks with published results for both. Amazon Nova Micro scores higher in 0 categories and Claude 3.7 Sonnet in 9 categories; 9 gaps are clear of the uncertainty.
- The widest gap is in instruction following, where Claude 3.7 Sonnet leads 72.9 to 56.3.
- The biggest single-benchmark swing is LiveBench Reasoning: 25.1% for Amazon Nova Micro and 87.8% for Claude 3.7 Sonnet.

## Snapshot

| | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| Provider | Amazon | Anthropic |
| Noometry Index | 30.4 | 39.5 |
| Rank | 294 | 164 |
| Context | 128K | — |
| Input $/M | $0.035 | — |
| Output $/M | $0.14 | — |
| Weights | Proprietary | Proprietary |

## Coding

- Amazon Nova Micro: 30.5 (#295)
- Claude 3.7 Sonnet: 40.6 (#136)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| LiveBench Coding | 20.2% | 74.5% |
| LMArena Coding | 1218 | 1361 |
| SWE-bench Verified | — | 61% |
| SWE-bench Verified (bash only) | — | 52.8% |
| Aider Polyglot | — | 64.9% |
| GSO | — | 3.8% |
| CadEval | — | 54% |

## Agentic & Tool Use

- Amazon Nova Micro: 22.1 (#132)
- Claude 3.7 Sonnet: 34.1 (#50)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| Berkeley Function Calling Leaderboard | 22.3% | — |
| TheAgentCompany | — | 30.9% |
| Cybench | — | 20% |
| DeepResearch Bench | — | 43.6% |
| OSWorld | — | 35.8% |
| METR Time Horizons | — | 60% |

## Reasoning

- Amazon Nova Micro: 17.4 (#294)
- Claude 3.7 Sonnet: 18.6 (#277)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| LiveBench Reasoning | 25.1% | 87.8% |
| LMArena Hard Prompts | 1191 | 1333 |
| LiveBench Data Analysis | 34% | 74% |
| LiveBench | 29.6% | 76.1% |
| ARC-AGI-2 | — | 0.9% |
| SimpleBench | — | 46.4% |
| ARC-AGI-1 | — | 28.6% |
| EnigmaEval | — | 4.2% |
| Epoch Capabilities Index | — | 141.16 |
| ForecastBench | — | 61.8 |

## Math

- Amazon Nova Micro: 26.9 (#254)
- Claude 3.7 Sonnet: 37.5 (#153)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| Omni-MATH | 21.4% | 33% |
| LiveBench Math | 34.5% | 79% |
| LMArena Math | 1206 | 1337 |
| OTIS Mock AIME 2024-2025 | — | 57.8% |
| MATH Level 5 | — | 91.2% |
| FrontierMath (Feb 2025 set) | — | 4.1% |

## Knowledge

- Amazon Nova Micro: 29.6 (#237)
- Claude 3.7 Sonnet: 39.8 (#130)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| MMLU-Pro | 51.1% | 78.4% |
| GPQA (HELM) | 38.3% | 60.8% |
| LMArena Expert | 1184 | 1321 |
| GPQA Diamond | — | 79.7% |
| Humanity's Last Exam | — | 8% |
| Confabulations | — | 14.7% |
| Vectara Hallucination Rate | 5.5% | — |
| MMLU | 70.8% | — |

## Multimodal

- Amazon Nova Micro: —
- Claude 3.7 Sonnet: 33.7 (#95)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| LMArena Vision | — | 1169 |
| GeoBench | — | 68% |
| VPCT | — | 39% |
| SpatialViz-Bench | — | 33.9% |

## Multilingual

- Amazon Nova Micro: 36.5 (#239)
- Claude 3.7 Sonnet: 44.1 (#179)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| LMArena Non-English | 1186 | 1296 |
| LMArena Chinese | 1209 | 1299 |
| LMArena French | 1238 | 1303 |
| LMArena German | 1192 | 1301 |
| LMArena Japanese | 1154 | 1267 |
| LMArena Korean | 1150 | 1249 |
| LMArena Russian | 1185 | 1311 |
| LMArena Spanish | 1225 | 1298 |

## Instruction Following

- Amazon Nova Micro: 56.3 (#272)
- Claude 3.7 Sonnet: 72.9 (#125)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| LiveBench Instruction Following | 48% | 81.3% |
| IFEval | 76% | 83.4% |
| LMArena Instruction Following | 1174 | 1352 |

## Long Context

- Amazon Nova Micro: 36.5 (#229)
- Claude 3.7 Sonnet: 50.3 (#10)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| LMArena Longer Query | 1205 | 1373 |
| Fiction.LiveBench | — | 83.3% |

## Writing & Preference

- Amazon Nova Micro: 39.5 (#247)
- Claude 3.7 Sonnet: 54.4 (#150)

| Benchmark | Amazon Nova Micro | Claude 3.7 Sonnet |
|---|---|---|
| LMArena Text | 1208 | 1314 |
| LMArena Creative Writing | 1172 | 1332 |
| WildBench | 74.3% | 81.4% |
| LMArena Multi-Turn | 1178 | 1339 |
| LiveBench Language | 15.8% | 59.9% |
| Short-Story Creative Writing | — | 81.1% |
| EQ-Bench Creative Writing | — | 1412 |

## FAQ

### Is Amazon Nova Micro better than Claude 3.7 Sonnet?

Claude 3.7 Sonnet is the stronger model overall, scoring 39.5 to 30.4 on the Noometry Index.

### Is Amazon Nova Micro or Claude 3.7 Sonnet better for coding?

Claude 3.7 Sonnet scores higher on coding benchmarks: 40.6 versus 30.5 in the Noometry coding category.

### How many benchmarks do Amazon Nova Micro and Claude 3.7 Sonnet share?

29 benchmarks have published results for both models. Amazon Nova Micro has 32 scored results on Noometry and Claude 3.7 Sonnet has 58.
