Model comparison

Qwen1.5 4b Chat vs Qwen3.5 Max Preview

Qwen3.5 Max Preview is the stronger model overall, scoring 45.3 to 28.8 on the Noometry Index.

Last verified . 13 shared benchmarks.

Qwen1.5 4b Chat Alibaba (Qwen)

28.8

Rank #322 Confirmed

Qwen3.5 Max Preview Alibaba (Qwen)

45.3

Rank #71 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Qwen1.5 4b Chat scores higher in 0 categories and Qwen3.5 Max Preview in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Qwen3.5 Max Preview leads 66.0 to 23.8.
  • Qwen1.5 4b Chat has downloadable open weights; the other is API-only.

Side by side

Qwen1.5 4b Chat and Qwen3.5 Max Preview specifications
Qwen1.5 4b ChatQwen3.5 Max Preview
ProviderAlibaba (Qwen)Alibaba (Qwen)
Noometry Index28.845.3
Released——
WeightsOpenProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked1317

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Qwen3.5 Max Preview leads

Qwen1.5 4b Chat: 29.1 (#308), Qwen3.5 Max Preview: 44.0 (#77)

Coding benchmarks
BenchmarkQwen1.5 4b ChatQwen3.5 Max Preview
LMArena Coding9991487

Reasoning Qwen3.5 Max Preview leads

Qwen1.5 4b Chat: 18.5 (#279), Qwen3.5 Max Preview: 30.8 (#84)

Reasoning benchmarks
BenchmarkQwen1.5 4b ChatQwen3.5 Max Preview
LMArena Hard Prompts9761483

Math Qwen3.5 Max Preview leads

Qwen1.5 4b Chat: 30.4 (#234), Qwen3.5 Max Preview: 40.1 (#94)

Math benchmarks
BenchmarkQwen1.5 4b ChatQwen3.5 Max Preview
LMArena Math10261474

Knowledge Qwen3.5 Max Preview leads

Qwen1.5 4b Chat: 26.7 (#255), Qwen3.5 Max Preview: 41.8 (#107)

Knowledge benchmarks
BenchmarkQwen1.5 4b ChatQwen3.5 Max Preview
LMArena Expert9801489

Multilingual Qwen3.5 Max Preview leads

Qwen1.5 4b Chat: 24.1 (#290), Qwen3.5 Max Preview: 56.2 (#22)

Multilingual benchmarks
BenchmarkQwen1.5 4b ChatQwen3.5 Max Preview
LMArena Non-English9791465
LMArena Chinese10241534
LMArena German9021487
LMArena Russian9521471
LMArena French—1484
LMArena Japanese—1495
LMArena Korean—1438
LMArena Spanish—1470

Instruction Following Qwen3.5 Max Preview leads

Qwen1.5 4b Chat: 49.0 (#300), Qwen3.5 Max Preview: 77.0 (#31)

Instruction Following benchmarks
BenchmarkQwen1.5 4b ChatQwen3.5 Max Preview
LMArena Instruction Following9781467

Long Context Qwen3.5 Max Preview leads

Qwen1.5 4b Chat: 30.1 (#290), Qwen3.5 Max Preview: 45.2 (#45)

Long Context benchmarks
BenchmarkQwen1.5 4b ChatQwen3.5 Max Preview
LMArena Longer Query9881476

Writing & Preference Qwen3.5 Max Preview leads

Qwen1.5 4b Chat: 23.8 (#309), Qwen3.5 Max Preview: 66.0 (#41)

Writing & Preference benchmarks
BenchmarkQwen1.5 4b ChatQwen3.5 Max Preview
LMArena Text9971470
LMArena Creative Writing9691464
LMArena Multi-Turn9771478

Frequently asked questions

Is Qwen1.5 4b Chat better than Qwen3.5 Max Preview?

Qwen3.5 Max Preview is the stronger model overall, scoring 45.3 to 28.8 on the Noometry Index.

Is Qwen1.5 4b Chat or Qwen3.5 Max Preview better for coding?

Qwen3.5 Max Preview scores higher on coding benchmarks: 44.0 versus 29.1 in the Noometry coding category.

How many benchmarks do Qwen1.5 4b Chat and Qwen3.5 Max Preview share?

13 benchmarks have published results for both models. Qwen1.5 4b Chat has 13 scored results on Noometry and Qwen3.5 Max Preview has 17.

Related comparisons

Go deeper