Model comparison

Hunyuan Large 2025 02 10 vs Muse Spark

Muse Spark is the stronger model overall, scoring 50.6 to 38.6 on the Noometry Index.

Last verified . 12 shared benchmarks.

Hunyuan Large 2025 02 10 Tencent

38.6

Rank #184 Confirmed

Muse Spark Meta

50.6

Rank #46 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Hunyuan Large 2025 02 10 scores higher in 0 categories and Muse Spark in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Muse Spark leads 65.7 to 35.1.

Side by side

Hunyuan Large 2025 02 10 and Muse Spark specifications
Hunyuan Large 2025 02 10Muse Spark
ProviderTencentMeta
Noometry Index38.650.6
Released—2026-04-08
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked1227

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Muse Spark leads

Hunyuan Large 2025 02 10: 38.2 (#181), Muse Spark: 46.2 (#69)

Coding benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Coding13071481
SciCode—51.5%

Reasoning Muse Spark leads

Hunyuan Large 2025 02 10: 25.5 (#148), Muse Spark: 35.9 (#67)

Reasoning benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Hard Prompts12861474
CritPt—11.3%
Epoch Capabilities Index—152.04

Math Muse Spark leads

Hunyuan Large 2025 02 10: 35.8 (#178), Muse Spark: 47.8 (#66)

Math benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Math12811455
OTIS Mock AIME 2024-2025—88.9%
ProofBench—17%
FrontierMath (Feb 2025 set)—39%
FrontierMath Tier 4 (v1)—14.6%

Knowledge Muse Spark leads

Hunyuan Large 2025 02 10: 35.1 (#188), Muse Spark: 65.7 (#13)

Knowledge benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Expert12761457
GPQA Diamond—89.8%
Humanity's Last Exam—40.6%

Multimodal Not comparable

Hunyuan Large 2025 02 10: —, Muse Spark: 43.4 (#24)

Multimodal benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Vision—1306
LMArena Document—1444

Multilingual Muse Spark leads

Hunyuan Large 2025 02 10: 42.0 (#200), Muse Spark: 56.1 (#24)

Multilingual benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Non-English12651464
LMArena Chinese13461509
LMArena Russian12661466
LMArena French—1497
LMArena German—1497
LMArena Korean—1459
LMArena Spanish—1472

Instruction Following Muse Spark leads

Hunyuan Large 2025 02 10: 67.3 (#197), Muse Spark: 75.9 (#51)

Instruction Following benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Instruction Following12771442

Long Context Muse Spark leads

Hunyuan Large 2025 02 10: 40.8 (#149), Muse Spark: 44.4 (#69)

Long Context benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Longer Query13411451

Writing & Preference Muse Spark leads

Hunyuan Large 2025 02 10: 48.7 (#197), Muse Spark: 66.0 (#39)

Writing & Preference benchmarks
BenchmarkHunyuan Large 2025 02 10Muse Spark
LMArena Text12881474
LMArena Creative Writing12641459
LMArena Multi-Turn12841477

Frequently asked questions

Is Hunyuan Large 2025 02 10 better than Muse Spark?

Muse Spark is the stronger model overall, scoring 50.6 to 38.6 on the Noometry Index.

Is Hunyuan Large 2025 02 10 or Muse Spark better for coding?

Muse Spark scores higher on coding benchmarks: 46.2 versus 38.2 in the Noometry coding category.

How many benchmarks do Hunyuan Large 2025 02 10 and Muse Spark share?

12 benchmarks have published results for both models. Hunyuan Large 2025 02 10 has 12 scored results on Noometry and Muse Spark has 27.

Related comparisons

Go deeper