Model comparison

Qwen3.5 27B vs Qwen3.5 Max Preview

Qwen3.5 Max Preview is the stronger model overall, scoring 45.3 to 41.9 on the Noometry Index.

Last verified . 17 shared benchmarks.

Qwen3.5 27B Alibaba (Qwen)

41.9

Rank #127 Confirmed

Qwen3.5 Max Preview Alibaba (Qwen)

45.3

Rank #71 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Qwen3.5 27B scores higher in 0 categories and Qwen3.5 Max Preview in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Qwen3.5 Max Preview leads 66.0 to 59.3.
  • Qwen3.5 27B has downloadable open weights; the other is API-only.

Side by side

Qwen3.5 27B and Qwen3.5 Max Preview specifications
Qwen3.5 27BQwen3.5 Max Preview
ProviderAlibaba (Qwen)Alibaba (Qwen)
Noometry Index41.945.3
Released2026-02-23—
WeightsOpenProprietary
Context window262K—
Max output66K—
Input $ / M tokens$0.30—
Output $ / M tokens$2.40—
Results tracked2817

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Qwen3.5 Max Preview leads

Qwen3.5 27B: 38.9 (#168), Qwen3.5 Max Preview: 44.0 (#77)

Coding benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Coding14271487
LMArena WebDev1358—
WeirdML39.5%—
ALE-Bench349.45—

Agentic & Tool Use Not comparable

Qwen3.5 27B: —, Qwen3.5 Max Preview: —

Agentic & Tool Use benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
Vending-Bench 2201.98—

Reasoning Qwen3.5 Max Preview leads

Qwen3.5 27B: 27.5 (#117), Qwen3.5 Max Preview: 30.8 (#84)

Reasoning benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Hard Prompts14141483
NYT Connections (extended)47.9%—
Thematic Generalization45.5%—
DTBench82.4%—
LMCA34%—

Math Qwen3.5 Max Preview leads

Qwen3.5 27B: 38.8 (#127), Qwen3.5 Max Preview: 40.1 (#94)

Math benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Math14291474
MathArena Final-Answer Competitions56.7%—

Knowledge Qwen3.5 Max Preview leads

Qwen3.5 27B: 38.0 (#150), Qwen3.5 Max Preview: 41.8 (#107)

Knowledge benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Expert14281489
Vectara Hallucination Rate12.1%—

Multimodal Not comparable

Qwen3.5 27B: 39.4 (#59), Qwen3.5 Max Preview: —

Multimodal benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Vision1241—

Multilingual Qwen3.5 Max Preview leads

Qwen3.5 27B: 50.8 (#115), Qwen3.5 Max Preview: 56.2 (#22)

Multilingual benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Non-English13901465
LMArena Chinese14781534
LMArena French14101484
LMArena German13931487
LMArena Japanese13451495
LMArena Korean13581438
LMArena Russian13901471
LMArena Spanish14071470

Instruction Following Qwen3.5 Max Preview leads

Qwen3.5 27B: 73.5 (#119), Qwen3.5 Max Preview: 77.0 (#31)

Instruction Following benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Instruction Following13931467

Long Context Qwen3.5 Max Preview leads

Qwen3.5 27B: 43.1 (#106), Qwen3.5 Max Preview: 45.2 (#45)

Long Context benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Longer Query14131476

Writing & Preference Qwen3.5 Max Preview leads

Qwen3.5 27B: 59.3 (#111), Qwen3.5 Max Preview: 66.0 (#41)

Writing & Preference benchmarks
BenchmarkQwen3.5 27BQwen3.5 Max Preview
LMArena Text14091470
LMArena Creative Writing13621464
LMArena Multi-Turn14101478

Frequently asked questions

Is Qwen3.5 27B better than Qwen3.5 Max Preview?

Qwen3.5 Max Preview is the stronger model overall, scoring 45.3 to 41.9 on the Noometry Index.

Is Qwen3.5 27B or Qwen3.5 Max Preview better for coding?

Qwen3.5 Max Preview scores higher on coding benchmarks: 44.0 versus 38.9 in the Noometry coding category.

How many benchmarks do Qwen3.5 27B and Qwen3.5 Max Preview share?

17 benchmarks have published results for both models. Qwen3.5 27B has 28 scored results on Noometry and Qwen3.5 Max Preview has 17.

Related comparisons

Go deeper