Model comparison

Qwen2.5 Plus 1127 vs Qwen3 Coder Next

Qwen2.5 Plus 1127 is the stronger model overall, scoring 38.8 to 34.3 on the Noometry Index.

Last verified . 0 shared benchmarks.

Qwen2.5 Plus 1127 Alibaba (Qwen)

38.8

Rank #181 Confirmed

Qwen3 Coder Next Alibaba (Qwen)

34.3

Rank #232 Reported

Summary

  • The widest gap is in reasoning, where Qwen2.5 Plus 1127 leads 25.9 to 22.4.
  • Qwen3 Coder Next has downloadable open weights; the other is API-only.

Side by side

Qwen2.5 Plus 1127 and Qwen3 Coder Next specifications
Qwen2.5 Plus 1127Qwen3 Coder Next
ProviderAlibaba (Qwen)Alibaba (Qwen)
Noometry Index38.834.3
Released—2026-02-02
WeightsProprietaryOpen
Context window—262K
Max output—66K
Input $ / M tokens—$0.12
Output $ / M tokens—$0.80
Results tracked143

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Qwen2.5 Plus 1127 leads

Qwen2.5 Plus 1127: 38.5 (#175), Qwen3 Coder Next: 36.3 (#210)

Coding benchmarks
BenchmarkQwen2.5 Plus 1127Qwen3 Coder Next
SciCode—32.3%
WeirdML—34.4%
LMArena Coding1314—

Reasoning Qwen2.5 Plus 1127 leads

Qwen2.5 Plus 1127: 25.9 (#141), Qwen3 Coder Next: 22.4 (#196)

Reasoning benchmarks
BenchmarkQwen2.5 Plus 1127Qwen3 Coder Next
CritPt—0%
LMArena Hard Prompts1299—

Math Not comparable

Qwen2.5 Plus 1127: 36.1 (#174), Qwen3 Coder Next: —

Math benchmarks
BenchmarkQwen2.5 Plus 1127Qwen3 Coder Next
LMArena Math1298—

Knowledge Not comparable

Qwen2.5 Plus 1127: 35.5 (#183), Qwen3 Coder Next: —

Knowledge benchmarks
BenchmarkQwen2.5 Plus 1127Qwen3 Coder Next
LMArena Expert1289—

Multilingual Not comparable

Qwen2.5 Plus 1127: 41.9 (#201), Qwen3 Coder Next: —

Multilingual benchmarks
BenchmarkQwen2.5 Plus 1127Qwen3 Coder Next
LMArena Non-English1265—
LMArena Chinese1314—
LMArena German1231—
LMArena Japanese1207—
LMArena Russian1271—

Instruction Following Not comparable

Qwen2.5 Plus 1127: 67.2 (#199), Qwen3 Coder Next: —

Instruction Following benchmarks
BenchmarkQwen2.5 Plus 1127Qwen3 Coder Next
LMArena Instruction Following1275—

Long Context Not comparable

Qwen2.5 Plus 1127: 39.2 (#184), Qwen3 Coder Next: —

Long Context benchmarks
BenchmarkQwen2.5 Plus 1127Qwen3 Coder Next
LMArena Longer Query1292—

Writing & Preference Not comparable

Qwen2.5 Plus 1127: 49.4 (#192), Qwen3 Coder Next: —

Writing & Preference benchmarks
BenchmarkQwen2.5 Plus 1127Qwen3 Coder Next
LMArena Text1299—
LMArena Creative Writing1262—
LMArena Multi-Turn1299—

Frequently asked questions

Is Qwen2.5 Plus 1127 better than Qwen3 Coder Next?

Qwen2.5 Plus 1127 is the stronger model overall, scoring 38.8 to 34.3 on the Noometry Index.

Is Qwen2.5 Plus 1127 or Qwen3 Coder Next better for coding?

Qwen2.5 Plus 1127 scores higher on coding benchmarks: 38.5 versus 36.3 in the Noometry coding category.

How many benchmarks do Qwen2.5 Plus 1127 and Qwen3 Coder Next share?

0 benchmarks have published results for both models. Qwen2.5 Plus 1127 has 14 scored results on Noometry and Qwen3 Coder Next has 3.

Related comparisons

Go deeper