# Hunyuan Standard 2025 02 10 vs Muse Spark 1.3

> Muse Spark 1.3 is the stronger model overall, scoring 54.8 to 37.9 on the Noometry Index.

- Canonical page: https://noometry.com/compare/hunyuan-standard-vs-muse-spark-1-3
- Last updated: 2026-10-10
- Shared benchmarks: 12

## Summary

- They share 12 benchmarks with published results for both. Hunyuan Standard 2025 02 10 scores higher in 0 categories and Muse Spark 1.3 in 8 categories; 8 gaps are clear of the uncertainty.
- The widest gap is in math, where Muse Spark 1.3 leads 73.1 to 35.6.

## Snapshot

| | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| Provider | Tencent | Meta |
| Noometry Index | 37.9 | 54.8 |
| Rank | 193 | 27 |
| Context | — | 1.05M |
| Input $/M | — | $1.25 |
| Output $/M | — | $4.25 |
| Weights | Proprietary | Proprietary |

## Coding

- Hunyuan Standard 2025 02 10: 37.1 (#197)
- Muse Spark 1.3: 56.6 (#21)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Coding | 1270 | 1514 |
| CursorBench | — | 41.6% |
| LMArena WebDev | — | 1657 |
| SciCode | — | 59.7% |

## Agentic & Tool Use

- Hunyuan Standard 2025 02 10: —
- Muse Spark 1.3: 38.6 (#30)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| APEX-Agents | — | 57.8% |
| GDP.pdf | — | 27.6% |

## Reasoning

- Hunyuan Standard 2025 02 10: 25.0 (#154)
- Muse Spark 1.3: 54.0 (#27)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Hard Prompts | 1264 | 1503 |
| NYT Connections (extended) | — | 85.1% |
| CritPt | — | 26% |
| Chess Puzzles | — | 38% |
| Mystery Game Puzzles | — | 25% |
| DTBench | — | 96.5% |
| LMCA | — | 53.9% |
| Bench to the Future 3 | — | 0.14 |
| Epoch Capabilities Index | — | 156.75 |

## Math

- Hunyuan Standard 2025 02 10: 35.6 (#179)
- Muse Spark 1.3: 73.1 (#21)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Math | 1274 | 1494 |
| FrontierMath (Tiers 1-3) | — | 74.4% |
| FrontierMath Tier 4 | — | 46.3% |
| OTIS Mock AIME 2024-2025 | — | 99.2% |
| ProofBench | — | 58% |

## Knowledge

- Hunyuan Standard 2025 02 10: 34.2 (#197)
- Muse Spark 1.3: 42.6 (#95)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Expert | 1248 | 1516 |

## Multimodal

- Hunyuan Standard 2025 02 10: —
- Muse Spark 1.3: 43.7 (#22)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Vision | — | 1309 |
| LMArena Document | — | 1471 |

## Multilingual

- Hunyuan Standard 2025 02 10: 41.7 (#203)
- Muse Spark 1.3: 57.4 (#8)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Non-English | 1262 | 1481 |
| LMArena Chinese | 1319 | 1529 |
| LMArena Russian | 1258 | 1490 |
| LMArena French | — | 1524 |
| LMArena German | — | 1515 |
| LMArena Japanese | — | 1474 |
| LMArena Korean | — | 1501 |
| LMArena Spanish | — | 1490 |

## Instruction Following

- Hunyuan Standard 2025 02 10: 65.5 (#219)
- Muse Spark 1.3: 77.5 (#22)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Instruction Following | 1245 | 1477 |

## Long Context

- Hunyuan Standard 2025 02 10: 39.5 (#173)
- Muse Spark 1.3: 45.6 (#32)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Longer Query | 1301 | 1488 |

## Writing & Preference

- Hunyuan Standard 2025 02 10: 47.2 (#214)
- Muse Spark 1.3: 73.6 (#9)

| Benchmark | Hunyuan Standard 2025 02 10 | Muse Spark 1.3 |
|---|---|---|
| LMArena Text | 1274 | 1490 |
| LMArena Creative Writing | 1242 | 1455 |
| LMArena Multi-Turn | 1275 | 1482 |
| EQ-Bench Creative Writing | — | 1906 |

## FAQ

### Is Hunyuan Standard 2025 02 10 better than Muse Spark 1.3?

Muse Spark 1.3 is the stronger model overall, scoring 54.8 to 37.9 on the Noometry Index.

### Is Hunyuan Standard 2025 02 10 or Muse Spark 1.3 better for coding?

Muse Spark 1.3 scores higher on coding benchmarks: 56.6 versus 37.1 in the Noometry coding category.

### How many benchmarks do Hunyuan Standard 2025 02 10 and Muse Spark 1.3 share?

12 benchmarks have published results for both models. Hunyuan Standard 2025 02 10 has 12 scored results on Noometry and Muse Spark 1.3 has 37.
