# Amazon Nova Experimental Chat 12 10 vs Muse Spark 1.3

> Muse Spark 1.3 is the stronger model overall, scoring 54.8 to 42.9 on the Noometry Index.

- Canonical page: https://noometry.com/compare/amazon-nova-experimental-chat-12-10-vs-muse-spark-1-3
- Last updated: 2026-10-10
- Shared benchmarks: 12

## Summary

- They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 12 10 scores higher in 0 categories and Muse Spark 1.3 in 8 categories; 8 gaps are clear of the uncertainty.
- The widest gap is in math, where Muse Spark 1.3 leads 73.1 to 38.9.

## Snapshot

| | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| Provider | Amazon | Meta |
| Noometry Index | 42.9 | 54.8 |
| Rank | 104 | 27 |
| Context | — | 1.05M |
| Input $/M | — | $1.25 |
| Output $/M | — | $4.25 |
| Weights | Proprietary | Proprietary |

## Coding

- Amazon Nova Experimental Chat 12 10: 42.2 (#110)
- Muse Spark 1.3: 56.6 (#21)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Coding | 1430 | 1514 |
| CursorBench | — | 41.6% |
| LMArena WebDev | — | 1657 |
| SciCode | — | 59.7% |

## Agentic & Tool Use

- Amazon Nova Experimental Chat 12 10: —
- Muse Spark 1.3: 38.6 (#30)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| APEX-Agents | — | 57.8% |
| GDP.pdf | — | 27.6% |

## Reasoning

- Amazon Nova Experimental Chat 12 10: 29.3 (#94)
- Muse Spark 1.3: 54.0 (#27)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Hard Prompts | 1427 | 1503 |
| NYT Connections (extended) | — | 85.1% |
| CritPt | — | 26% |
| Chess Puzzles | — | 38% |
| Mystery Game Puzzles | — | 25% |
| DTBench | — | 96.5% |
| LMCA | — | 53.9% |
| Bench to the Future 3 | — | 0.14 |
| Epoch Capabilities Index | — | 156.75 |

## Math

- Amazon Nova Experimental Chat 12 10: 38.9 (#124)
- Muse Spark 1.3: 73.1 (#21)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Math | 1419 | 1494 |
| FrontierMath (Tiers 1-3) | — | 74.4% |
| FrontierMath Tier 4 | — | 46.3% |
| OTIS Mock AIME 2024-2025 | — | 99.2% |
| ProofBench | — | 58% |

## Knowledge

- Amazon Nova Experimental Chat 12 10: 39.2 (#136)
- Muse Spark 1.3: 42.6 (#95)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Expert | 1408 | 1516 |

## Multimodal

- Amazon Nova Experimental Chat 12 10: —
- Muse Spark 1.3: 43.7 (#22)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Vision | — | 1309 |
| LMArena Document | — | 1471 |

## Multilingual

- Amazon Nova Experimental Chat 12 10: 51.4 (#108)
- Muse Spark 1.3: 57.4 (#8)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Non-English | 1398 | 1481 |
| LMArena Chinese | 1440 | 1529 |
| LMArena Russian | 1395 | 1490 |
| LMArena French | — | 1524 |
| LMArena German | — | 1515 |
| LMArena Japanese | — | 1474 |
| LMArena Korean | — | 1501 |
| LMArena Spanish | — | 1490 |

## Instruction Following

- Amazon Nova Experimental Chat 12 10: 73.2 (#123)
- Muse Spark 1.3: 77.5 (#22)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Instruction Following | 1387 | 1477 |

## Long Context

- Amazon Nova Experimental Chat 12 10: 42.4 (#125)
- Muse Spark 1.3: 45.6 (#32)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Longer Query | 1391 | 1488 |

## Writing & Preference

- Amazon Nova Experimental Chat 12 10: 59.5 (#110)
- Muse Spark 1.3: 73.6 (#9)

| Benchmark | Amazon Nova Experimental Chat 12 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Text | 1420 | 1490 |
| LMArena Creative Writing | 1350 | 1455 |
| LMArena Multi-Turn | 1409 | 1482 |
| EQ-Bench Creative Writing | — | 1906 |

## FAQ

### Is Amazon Nova Experimental Chat 12 10 better than Muse Spark 1.3?

Muse Spark 1.3 is the stronger model overall, scoring 54.8 to 42.9 on the Noometry Index.

### Is Amazon Nova Experimental Chat 12 10 or Muse Spark 1.3 better for coding?

Muse Spark 1.3 scores higher on coding benchmarks: 56.6 versus 42.2 in the Noometry coding category.

### How many benchmarks do Amazon Nova Experimental Chat 12 10 and Muse Spark 1.3 share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 12 10 has 12 scored results on Noometry and Muse Spark 1.3 has 37.
