Model comparison

Amazon Nova Experimental Chat 26 01 10 vs Qwen3.6 35B-A3B

Amazon Nova Experimental Chat 26 01 10 is the stronger model overall, scoring 42.8 to 37.6 on the Noometry Index.

Last verified . 0 shared benchmarks.

Qwen3.6 35B-A3B Alibaba (Qwen)

37.6

Rank #201 Confirmed

Summary

  • The widest gap is in knowledge, where Qwen3.6 35B-A3B leads 51.3 to 40.3.
  • Qwen3.6 35B-A3B has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Experimental Chat 26 01 10 and Qwen3.6 35B-A3B specifications
Amazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
ProviderAmazonAlibaba (Qwen)
Noometry Index42.837.6
Released—2026-04-01
WeightsProprietaryOpen
Context window—262K
Max output—66K
Input $ / M tokens—$0.25
Output $ / M tokens—$1.49
Results tracked1314

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 26 01 10 leads

Amazon Nova Experimental Chat 26 01 10: 42.7 (#96), Qwen3.6 35B-A3B: 37.2 (#196)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
SciCode—35.8%
WeirdML—34.5%
LMArena Coding1447—

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 26 01 10: —, Qwen3.6 35B-A3B: 22.1 (#134)

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
Terminal-Bench—23%

Reasoning Too close to call

Amazon Nova Experimental Chat 26 01 10: 28.9 (#98), Qwen3.6 35B-A3B: 28.0 (#109)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
NYT Connections (extended)—41.6%
CritPt—0.3%
Chess Puzzles—26%
LMArena Hard Prompts1415—
Mystery Game Puzzles—22%
DTBench—73.9%
LMCA—29.7%
Surface Evolver Bench—44.4%
Epoch Capabilities Index—143.93

Math Too close to call

Amazon Nova Experimental Chat 26 01 10: 38.5 (#136), Qwen3.6 35B-A3B: 38.9 (#121)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
FrontierMath (Tiers 1-3)—20.4%
OTIS Mock AIME 2024-2025—86.7%
LMArena Math1404—

Knowledge Qwen3.6 35B-A3B leads

Amazon Nova Experimental Chat 26 01 10: 40.3 (#120), Qwen3.6 35B-A3B: 51.3 (#68)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
GPQA Diamond—84.8%
LMArena Expert1444—

Multilingual Not comparable

Amazon Nova Experimental Chat 26 01 10: 50.2 (#126), Qwen3.6 35B-A3B: —

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
LMArena Non-English1381—
LMArena Chinese1372—
LMArena Russian1391—
LMArena Spanish1390—

Instruction Following Not comparable

Amazon Nova Experimental Chat 26 01 10: 72.9 (#126), Qwen3.6 35B-A3B: —

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
LMArena Instruction Following1381—

Long Context Not comparable

Amazon Nova Experimental Chat 26 01 10: 42.7 (#119), Qwen3.6 35B-A3B: —

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
LMArena Longer Query1400—

Writing & Preference Not comparable

Amazon Nova Experimental Chat 26 01 10: 57.4 (#129), Qwen3.6 35B-A3B: —

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3.6 35B-A3B
LMArena Text1396—
LMArena Creative Writing1331—
LMArena Multi-Turn1380—

Frequently asked questions

Is Amazon Nova Experimental Chat 26 01 10 better than Qwen3.6 35B-A3B?

Amazon Nova Experimental Chat 26 01 10 is the stronger model overall, scoring 42.8 to 37.6 on the Noometry Index.

Is Amazon Nova Experimental Chat 26 01 10 or Qwen3.6 35B-A3B better for coding?

Amazon Nova Experimental Chat 26 01 10 scores higher on coding benchmarks: 42.7 versus 37.2 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 26 01 10 and Qwen3.6 35B-A3B share?

0 benchmarks have published results for both models. Amazon Nova Experimental Chat 26 01 10 has 13 scored results on Noometry and Qwen3.6 35B-A3B has 14.

Related comparisons

Go deeper