Model comparison

Hunyuan Standard 2025 02 10 vs Muse Spark

Muse Spark is the stronger model overall, scoring 50.6 to 37.9 on the Noometry Index.

Last verified . 12 shared benchmarks.

Hunyuan Standard 2025 02 10 Tencent

37.9

Rank #193 Confirmed

Muse Spark Meta

50.6

Rank #46 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Hunyuan Standard 2025 02 10 scores higher in 0 categories and Muse Spark in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Muse Spark leads 65.7 to 34.2.

Side by side

Hunyuan Standard 2025 02 10 and Muse Spark specifications
Hunyuan Standard 2025 02 10Muse Spark
ProviderTencentMeta
Noometry Index37.950.6
Released—2026-04-08
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked1227

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Muse Spark leads

Hunyuan Standard 2025 02 10: 37.1 (#197), Muse Spark: 46.2 (#69)

Coding benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Coding12701481
SciCode—51.5%

Reasoning Muse Spark leads

Hunyuan Standard 2025 02 10: 25.0 (#154), Muse Spark: 35.9 (#67)

Reasoning benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Hard Prompts12641474
CritPt—11.3%
Epoch Capabilities Index—152.04

Math Muse Spark leads

Hunyuan Standard 2025 02 10: 35.6 (#179), Muse Spark: 47.8 (#66)

Math benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Math12741455
OTIS Mock AIME 2024-2025—88.9%
ProofBench—17%
FrontierMath (Feb 2025 set)—39%
FrontierMath Tier 4 (v1)—14.6%

Knowledge Muse Spark leads

Hunyuan Standard 2025 02 10: 34.2 (#197), Muse Spark: 65.7 (#13)

Knowledge benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Expert12481457
GPQA Diamond—89.8%
Humanity's Last Exam—40.6%

Multimodal Not comparable

Hunyuan Standard 2025 02 10: —, Muse Spark: 43.4 (#24)

Multimodal benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Vision—1306
LMArena Document—1444

Multilingual Muse Spark leads

Hunyuan Standard 2025 02 10: 41.7 (#203), Muse Spark: 56.1 (#24)

Multilingual benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Non-English12621464
LMArena Chinese13191509
LMArena Russian12581466
LMArena French—1497
LMArena German—1497
LMArena Korean—1459
LMArena Spanish—1472

Instruction Following Muse Spark leads

Hunyuan Standard 2025 02 10: 65.5 (#219), Muse Spark: 75.9 (#51)

Instruction Following benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Instruction Following12451442

Long Context Muse Spark leads

Hunyuan Standard 2025 02 10: 39.5 (#173), Muse Spark: 44.4 (#69)

Long Context benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Longer Query13011451

Writing & Preference Muse Spark leads

Hunyuan Standard 2025 02 10: 47.2 (#214), Muse Spark: 66.0 (#39)

Writing & Preference benchmarks
BenchmarkHunyuan Standard 2025 02 10Muse Spark
LMArena Text12741474
LMArena Creative Writing12421459
LMArena Multi-Turn12751477

Frequently asked questions

Is Hunyuan Standard 2025 02 10 better than Muse Spark?

Muse Spark is the stronger model overall, scoring 50.6 to 37.9 on the Noometry Index.

Is Hunyuan Standard 2025 02 10 or Muse Spark better for coding?

Muse Spark scores higher on coding benchmarks: 46.2 versus 37.1 in the Noometry coding category.

How many benchmarks do Hunyuan Standard 2025 02 10 and Muse Spark share?

12 benchmarks have published results for both models. Hunyuan Standard 2025 02 10 has 12 scored results on Noometry and Muse Spark has 27.

Related comparisons

Go deeper