Model comparison

ERNIE 5.0 0110 vs Qwen3.7 Plus

Qwen3.7 Plus is the stronger model overall, scoring 45.3 to 41.8 on the Noometry Index.

Last verified . 19 shared benchmarks.

ERNIE 5.0 0110 Baidu

41.8

Rank #129 Confirmed

Qwen3.7 Plus Alibaba (Qwen)

45.3

Rank #72 Confirmed

Summary

  • They share 19 benchmarks with published results for both. ERNIE 5.0 0110 scores higher in 1 category and Qwen3.7 Plus in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Qwen3.7 Plus leads 39.3 to 17.0.
  • The biggest single-benchmark swing is NYT Connections (extended): 10.3% for ERNIE 5.0 0110 and 74.8% for Qwen3.7 Plus.

Side by side

ERNIE 5.0 0110 and Qwen3.7 Plus specifications
ERNIE 5.0 0110Qwen3.7 Plus
ProviderBaiduAlibaba (Qwen)
Noometry Index41.845.3
Released—2026-06-02
WeightsProprietaryProprietary
Context window—1M
Max output—131K
Input $ / M tokens—$0.40
Output $ / M tokens—$1.60
Results tracked2032

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding ERNIE 5.0 0110 leads

ERNIE 5.0 0110: 43.0 (#94), Qwen3.7 Plus: 36.6 (#206)

Coding benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
LMArena Coding14551473
FrontierCode—10.2%
SciCode—45.5%

Agentic & Tool Use Not comparable

ERNIE 5.0 0110: —, Qwen3.7 Plus: 21.4 (#138)

Agentic & Tool Use benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
OSWorld 2.0—2.8%

Reasoning Qwen3.7 Plus leads

ERNIE 5.0 0110: 17.0 (#297), Qwen3.7 Plus: 39.3 (#59)

Reasoning benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
NYT Connections (extended)10.3%74.8%
LMArena Hard Prompts14451460
CritPt—9.1%
Chess Puzzles—24%
Thematic Generalization41.7%—
Mystery Game Puzzles—17%
DTBench—84%
LMCA—37.6%
Epoch Capabilities Index—147.37

Math Qwen3.7 Plus leads

ERNIE 5.0 0110: 39.3 (#110), Qwen3.7 Plus: 50.5 (#56)

Math benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
LMArena Math14371466
FrontierMath (Tiers 1-3)—34.4%
OTIS Mock AIME 2024-2025—93.3%

Knowledge Qwen3.7 Plus leads

ERNIE 5.0 0110: 39.8 (#128), Qwen3.7 Plus: 54.9 (#51)

Knowledge benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
LMArena Expert14281467
GPQA Diamond—87.9%

Multimodal Qwen3.7 Plus leads

ERNIE 5.0 0110: 39.9 (#53), Qwen3.7 Plus: 41.8 (#33)

Multimodal benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
LMArena Vision12491279
LMArena Document—1444

Multilingual Too close to call

ERNIE 5.0 0110: 54.1 (#49), Qwen3.7 Plus: 54.8 (#38)

Multilingual benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
LMArena Non-English14361445
LMArena Chinese15121510
LMArena French14671473
LMArena German14601471
LMArena Japanese13821413
LMArena Korean14061415
LMArena Russian14461457
LMArena Spanish14731457

Instruction Following Qwen3.7 Plus leads

ERNIE 5.0 0110: 74.5 (#92), Qwen3.7 Plus: 75.8 (#52)

Instruction Following benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
LMArena Instruction Following14131440

Long Context Qwen3.7 Plus leads

ERNIE 5.0 0110: 43.4 (#95), Qwen3.7 Plus: 44.5 (#65)

Long Context benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
LMArena Longer Query14221455

Writing & Preference Qwen3.7 Plus leads

ERNIE 5.0 0110: 63.1 (#66), Qwen3.7 Plus: 64.3 (#56)

Writing & Preference benchmarks
BenchmarkERNIE 5.0 0110Qwen3.7 Plus
LMArena Text14451455
LMArena Creative Writing14261439
LMArena Multi-Turn14341460

Frequently asked questions

Is ERNIE 5.0 0110 better than Qwen3.7 Plus?

Qwen3.7 Plus is the stronger model overall, scoring 45.3 to 41.8 on the Noometry Index.

Is ERNIE 5.0 0110 or Qwen3.7 Plus better for coding?

ERNIE 5.0 0110 scores higher on coding benchmarks: 43.0 versus 36.6 in the Noometry coding category.

How many benchmarks do ERNIE 5.0 0110 and Qwen3.7 Plus share?

19 benchmarks have published results for both models. ERNIE 5.0 0110 has 20 scored results on Noometry and Qwen3.7 Plus has 32.

Related comparisons

Go deeper