Model comparison

Amazon Nova Experimental Chat 12 10 vs Qwen3.5 27B

Amazon Nova Experimental Chat 12 10 is the stronger model overall, scoring 42.9 to 41.9 on the Noometry Index.

Last verified . 12 shared benchmarks.

Qwen3.5 27B Alibaba (Qwen)

41.9

Rank #127 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 12 10 scores higher in 6 categories and Qwen3.5 27B in 2 categories; 3 gaps are clear of the uncertainty.
  • The widest gap is in coding, where Amazon Nova Experimental Chat 12 10 leads 42.2 to 38.9.
  • Qwen3.5 27B has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Experimental Chat 12 10 and Qwen3.5 27B specifications
Amazon Nova Experimental Chat 12 10Qwen3.5 27B
ProviderAmazonAlibaba (Qwen)
Noometry Index42.941.9
Released—2026-02-23
WeightsProprietaryOpen
Context window—262K
Max output—66K
Input $ / M tokens—$0.30
Output $ / M tokens—$2.40
Results tracked1228

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Experimental Chat 12 10 leads

Amazon Nova Experimental Chat 12 10: 42.2 (#110), Qwen3.5 27B: 38.9 (#168)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Coding14301427
LMArena WebDev—1358
WeirdML—39.5%
ALE-Bench—349.45

Agentic & Tool Use Not comparable

Amazon Nova Experimental Chat 12 10: —, Qwen3.5 27B: —

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
Vending-Bench 2—201.98

Reasoning Amazon Nova Experimental Chat 12 10 leads

Amazon Nova Experimental Chat 12 10: 29.3 (#94), Qwen3.5 27B: 27.5 (#117)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Hard Prompts14271414
NYT Connections (extended)—47.9%
Thematic Generalization—45.5%
DTBench—82.4%
LMCA—34%

Math Too close to call

Amazon Nova Experimental Chat 12 10: 38.9 (#124), Qwen3.5 27B: 38.8 (#127)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Math14191429
MathArena Final-Answer Competitions—56.7%

Knowledge Amazon Nova Experimental Chat 12 10 leads

Amazon Nova Experimental Chat 12 10: 39.2 (#136), Qwen3.5 27B: 38.0 (#150)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Expert14081428
Vectara Hallucination Rate—12.1%

Multimodal Not comparable

Amazon Nova Experimental Chat 12 10: —, Qwen3.5 27B: 39.4 (#59)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Vision—1241

Multilingual Too close to call

Amazon Nova Experimental Chat 12 10: 51.4 (#108), Qwen3.5 27B: 50.8 (#115)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Non-English13981390
LMArena Chinese14401478
LMArena Russian13951390
LMArena French—1410
LMArena German—1393
LMArena Japanese—1345
LMArena Korean—1358
LMArena Spanish—1407

Instruction Following Too close to call

Amazon Nova Experimental Chat 12 10: 73.2 (#123), Qwen3.5 27B: 73.5 (#119)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Instruction Following13871393

Long Context Too close to call

Amazon Nova Experimental Chat 12 10: 42.4 (#125), Qwen3.5 27B: 43.1 (#106)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Longer Query13911413

Writing & Preference Too close to call

Amazon Nova Experimental Chat 12 10: 59.5 (#110), Qwen3.5 27B: 59.3 (#111)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 12 10Qwen3.5 27B
LMArena Text14201409
LMArena Creative Writing13501362
LMArena Multi-Turn14091410

Frequently asked questions

Is Amazon Nova Experimental Chat 12 10 better than Qwen3.5 27B?

Amazon Nova Experimental Chat 12 10 is the stronger model overall, scoring 42.9 to 41.9 on the Noometry Index.

Is Amazon Nova Experimental Chat 12 10 or Qwen3.5 27B better for coding?

Amazon Nova Experimental Chat 12 10 scores higher on coding benchmarks: 42.2 versus 38.9 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 12 10 and Qwen3.5 27B share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 12 10 has 12 scored results on Noometry and Qwen3.5 27B has 28.

Related comparisons

Go deeper