Model comparison

ERNIE 5.0 0110 vs Muse Spark 1.3

Muse Spark 1.3 is the stronger model overall, scoring 54.8 to 41.8 on the Noometry Index.

Last verified . 19 shared benchmarks.

ERNIE 5.0 0110 Baidu

41.8

Rank #129 Confirmed

Muse Spark 1.3 Meta

54.8

Rank #27 Confirmed

Summary

  • They share 19 benchmarks with published results for both. ERNIE 5.0 0110 scores higher in 0 categories and Muse Spark 1.3 in 9 categories; 9 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Muse Spark 1.3 leads 54.0 to 17.0.
  • The biggest single-benchmark swing is NYT Connections (extended): 10.3% for ERNIE 5.0 0110 and 85.1% for Muse Spark 1.3.

Side by side

ERNIE 5.0 0110 and Muse Spark 1.3 specifications
ERNIE 5.0 0110Muse Spark 1.3
ProviderBaiduMeta
Noometry Index41.854.8
Released—2026-09-02
WeightsProprietaryProprietary
Context window—1.05M
Max output—131K
Input $ / M tokens—$1.25
Output $ / M tokens—$4.25
Results tracked2037

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Muse Spark 1.3 leads

ERNIE 5.0 0110: 43.0 (#94), Muse Spark 1.3: 56.6 (#21)

Coding benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
LMArena Coding14551514
CursorBench—41.6%
LMArena WebDev—1657
SciCode—59.7%

Agentic & Tool Use Not comparable

ERNIE 5.0 0110: —, Muse Spark 1.3: 38.6 (#30)

Agentic & Tool Use benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
APEX-Agents—57.8%
GDP.pdf—27.6%

Reasoning Muse Spark 1.3 leads

ERNIE 5.0 0110: 17.0 (#297), Muse Spark 1.3: 54.0 (#27)

Reasoning benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
NYT Connections (extended)10.3%85.1%
LMArena Hard Prompts14451503
CritPt—26%
Chess Puzzles—38%
Thematic Generalization41.7%—
Mystery Game Puzzles—25%
DTBench—96.5%
LMCA—53.9%
Bench to the Future 3—0.14
Epoch Capabilities Index—156.75

Math Muse Spark 1.3 leads

ERNIE 5.0 0110: 39.3 (#110), Muse Spark 1.3: 73.1 (#21)

Math benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
LMArena Math14371494
FrontierMath (Tiers 1-3)—74.4%
FrontierMath Tier 4—46.3%
OTIS Mock AIME 2024-2025—99.2%
ProofBench—58%

Knowledge Muse Spark 1.3 leads

ERNIE 5.0 0110: 39.8 (#128), Muse Spark 1.3: 42.6 (#95)

Knowledge benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
LMArena Expert14281516

Multimodal Muse Spark 1.3 leads

ERNIE 5.0 0110: 39.9 (#53), Muse Spark 1.3: 43.7 (#22)

Multimodal benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
LMArena Vision12491309
LMArena Document—1471

Multilingual Muse Spark 1.3 leads

ERNIE 5.0 0110: 54.1 (#49), Muse Spark 1.3: 57.4 (#8)

Multilingual benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
LMArena Non-English14361481
LMArena Chinese15121529
LMArena French14671524
LMArena German14601515
LMArena Japanese13821474
LMArena Korean14061501
LMArena Russian14461490
LMArena Spanish14731490

Instruction Following Muse Spark 1.3 leads

ERNIE 5.0 0110: 74.5 (#92), Muse Spark 1.3: 77.5 (#22)

Instruction Following benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
LMArena Instruction Following14131477

Long Context Muse Spark 1.3 leads

ERNIE 5.0 0110: 43.4 (#95), Muse Spark 1.3: 45.6 (#32)

Long Context benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
LMArena Longer Query14221488

Writing & Preference Muse Spark 1.3 leads

ERNIE 5.0 0110: 63.1 (#66), Muse Spark 1.3: 73.6 (#9)

Writing & Preference benchmarks
BenchmarkERNIE 5.0 0110Muse Spark 1.3
LMArena Text14451490
LMArena Creative Writing14261455
LMArena Multi-Turn14341482
EQ-Bench Creative Writing—1906

Frequently asked questions

Is ERNIE 5.0 0110 better than Muse Spark 1.3?

Muse Spark 1.3 is the stronger model overall, scoring 54.8 to 41.8 on the Noometry Index.

Is ERNIE 5.0 0110 or Muse Spark 1.3 better for coding?

Muse Spark 1.3 scores higher on coding benchmarks: 56.6 versus 43.0 in the Noometry coding category.

How many benchmarks do ERNIE 5.0 0110 and Muse Spark 1.3 share?

19 benchmarks have published results for both models. ERNIE 5.0 0110 has 20 scored results on Noometry and Muse Spark 1.3 has 37.

Related comparisons

Go deeper