Model comparison

Qwen3.6 Max Preview vs Yi-Lightning

Qwen3.6 Max Preview is the stronger model overall, scoring 51.5 to 37.1 on the Noometry Index.

Last verified . 14 shared benchmarks.

Qwen3.6 Max Preview Alibaba (Qwen)

51.5

Rank #43 Confirmed

Yi-Lightning 01.AI

37.1

Rank #209 Confirmed

Summary

  • They share 14 benchmarks with published results for both. Qwen3.6 Max Preview scores higher in 8 categories and Yi-Lightning in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where Qwen3.6 Max Preview leads 57.6 to 35.4.

Side by side

Qwen3.6 Max Preview and Yi-Lightning specifications
Qwen3.6 Max PreviewYi-Lightning
ProviderAlibaba (Qwen)01.AI
Noometry Index51.537.1
Released2026-04-202024-12-02
WeightsProprietaryProprietary
Context window262K—
Max output66K—
Input $ / M tokens$1.30—
Output $ / M tokens$7.80—
Results tracked2918

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Qwen3.6 Max Preview leads

Qwen3.6 Max Preview: 48.7 (#54), Yi-Lightning: 27.4 (#320)

Coding benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
LMArena Coding14711312
SWE-bench Verified76.7%—
Aider Polyglot—12.9%
LMArena WebDev1482—

Agentic & Tool Use Not comparable

Qwen3.6 Max Preview: —, Yi-Lightning: —

Agentic & Tool Use benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
Vending-Bench 24,254—

Reasoning Qwen3.6 Max Preview leads

Qwen3.6 Max Preview: 41.7 (#53), Yi-Lightning: 25.9 (#139)

Reasoning benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
LMArena Hard Prompts14571302
SimpleBench63%—
NYT Connections (extended)74.1%—
Chess Puzzles20%—
Mystery Game Puzzles19%—
DTBench87.2%—
LMCA42.5%—
Epoch Capabilities Index149.24—

Math Qwen3.6 Max Preview leads

Qwen3.6 Max Preview: 54.1 (#46), Yi-Lightning: 36.2 (#172)

Math benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
LMArena Math14651300
OTIS Mock AIME 2024-202591.1%—
FrontierMath (Feb 2025 set)23.1%—
FrontierMath Tier 4 (v1)4.2%—

Knowledge Qwen3.6 Max Preview leads

Qwen3.6 Max Preview: 57.6 (#39), Yi-Lightning: 35.4 (#185)

Knowledge benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
LMArena Expert14781286
GPQA Diamond87.4%—
SimpleQA Verified52%—

Multilingual Qwen3.6 Max Preview leads

Qwen3.6 Max Preview: 54.2 (#48), Yi-Lightning: 42.2 (#196)

Multilingual benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
LMArena Non-English14371269
LMArena Chinese14871320
LMArena French14491305
LMArena Russian14451255
LMArena Spanish14541315
LMArena German—1267
LMArena Japanese—1228
LMArena Korean—1192

Instruction Following Qwen3.6 Max Preview leads

Qwen3.6 Max Preview: 75.7 (#55), Yi-Lightning: 67.4 (#196)

Instruction Following benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
LMArena Instruction Following14381278

Long Context Qwen3.6 Max Preview leads

Qwen3.6 Max Preview: 44.6 (#61), Yi-Lightning: 39.4 (#181)

Long Context benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
LMArena Longer Query14571297

Writing & Preference Qwen3.6 Max Preview leads

Qwen3.6 Max Preview: 63.8 (#60), Yi-Lightning: 50.2 (#184)

Writing & Preference benchmarks
BenchmarkQwen3.6 Max PreviewYi-Lightning
LMArena Text14471302
LMArena Creative Writing14351280
LMArena Multi-Turn14561311

Frequently asked questions

Is Qwen3.6 Max Preview better than Yi-Lightning?

Qwen3.6 Max Preview is the stronger model overall, scoring 51.5 to 37.1 on the Noometry Index.

Is Qwen3.6 Max Preview or Yi-Lightning better for coding?

Qwen3.6 Max Preview scores higher on coding benchmarks: 48.7 versus 27.4 in the Noometry coding category.

How many benchmarks do Qwen3.6 Max Preview and Yi-Lightning share?

14 benchmarks have published results for both models. Qwen3.6 Max Preview has 29 scored results on Noometry and Yi-Lightning has 18.

Related comparisons

Go deeper