Model comparison

Amazon Nova Experimental Chat 26 02 10 vs Inkling-Small

Inkling-Small is the stronger model overall, scoring 46.5 to 44.5 on the Noometry Index.

Last verified . 12 shared benchmarks.

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 26 02 10 scores higher in 5 categories and Inkling-Small in 3 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Inkling-Small leads 38.6 to 30.1.
  • Inkling-Small has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Experimental Chat 26 02 10 and Inkling-Small specifications
Amazon Nova Experimental Chat 26 02 10Inkling-Small
ProviderAmazonThinking Machines Lab
Noometry Index44.546.5
Released—2026-07-15
WeightsProprietaryOpen
Context window—524K
Max output—1.05M
Input $ / M tokens—$0.45
Output $ / M tokens—$1.20
Results tracked1233

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Amazon Nova Experimental Chat 26 02 10: 43.9 (#82), Inkling-Small: 43.6 (#85)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Coding14831451
LMArena WebDev—1409
SciCode—48.7%

Reasoning Inkling-Small leads

Amazon Nova Experimental Chat 26 02 10: 30.1 (#86), Inkling-Small: 38.6 (#63)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Hard Prompts14581423
ARC-AGI-2—40.1%
ARC-AGI-1—84%
CritPt—8.3%
Chess Puzzles—18%
Mystery Game Puzzles—6%
Epoch Capabilities Index—150.15

Math Inkling-Small leads

Amazon Nova Experimental Chat 26 02 10: 39.3 (#109), Inkling-Small: 45.1 (#77)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Math14381459
FrontierMath (Tiers 1-3)—46.3%
FrontierMath Tier 4—17.1%
OTIS Mock AIME 2024-2025—90%
ProofBench—6%

Knowledge Inkling-Small leads

Amazon Nova Experimental Chat 26 02 10: 42.3 (#97), Inkling-Small: 48.2 (#77)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Expert15061442
GPQA Diamond—88.5%
SimpleQA Verified—19.1%

Multimodal Not comparable

Amazon Nova Experimental Chat 26 02 10: —, Inkling-Small: 39.1 (#62)

Multimodal benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Vision—1235

Multilingual Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 54.0 (#50), Inkling-Small: 51.7 (#104)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Non-English14341402
LMArena Chinese14631465
LMArena Russian14231391
LMArena French—1436
LMArena German—1405
LMArena Japanese—1405
LMArena Korean—1363
LMArena Spanish—1428

Instruction Following Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 75.2 (#69), Inkling-Small: 73.8 (#114)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Instruction Following14271399

Long Context Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 44.0 (#77), Inkling-Small: 42.7 (#118)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Longer Query14411401

Writing & Preference Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 61.8 (#84), Inkling-Small: 59.6 (#107)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Inkling-Small
LMArena Text14481414
LMArena Creative Writing13681331
LMArena Multi-Turn14421418
EQ-Bench Creative Writing—1491

Frequently asked questions

Is Amazon Nova Experimental Chat 26 02 10 better than Inkling-Small?

Inkling-Small is the stronger model overall, scoring 46.5 to 44.5 on the Noometry Index.

Is Amazon Nova Experimental Chat 26 02 10 or Inkling-Small better for coding?

They score almost the same on coding (43.9 vs 43.6); test both on your own repository before choosing.

How many benchmarks do Amazon Nova Experimental Chat 26 02 10 and Inkling-Small share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 26 02 10 has 12 scored results on Noometry and Inkling-Small has 33.

Related comparisons

Go deeper