Model comparison

C4ai Aya Expanse 8b vs Claude Sonnet 5.5

Claude Sonnet 5.5 is the stronger model overall, scoring 61.9 to 34.9 on the Noometry Index.

Last verified . 12 shared benchmarks.

C4ai Aya Expanse 8b Cohere

34.9

Rank #229 Confirmed

Claude Sonnet 5.5 Anthropic

61.9

Rank #10 Confirmed

Summary

  • They share 12 benchmarks with published results for both. C4ai Aya Expanse 8b scores higher in 0 categories and Claude Sonnet 5.5 in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Claude Sonnet 5.5 leads 87.9 to 33.3.
  • C4ai Aya Expanse 8b has downloadable open weights; the other is API-only.

Side by side

C4ai Aya Expanse 8b and Claude Sonnet 5.5 specifications
C4ai Aya Expanse 8bClaude Sonnet 5.5
ProviderCohereAnthropic
Noometry Index34.961.9
Released—2026-09-28
WeightsOpenProprietary
Context window—1M
Max output—128K
Input $ / M tokens—$2
Output $ / M tokens—$10
Results tracked1532

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude Sonnet 5.5 leads

C4ai Aya Expanse 8b: 33.8 (#252), Claude Sonnet 5.5: 67.3 (#6)

Coding benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Coding11601513
FrontierCode—52.1%
CursorBench—55.5%
LMArena WebDev—1774
FrontierSWE—61.9%
SciCode—61%
ALE-Bench—1,819

Agentic & Tool Use Not comparable

C4ai Aya Expanse 8b: —, Claude Sonnet 5.5: 45.0 (#16)

Agentic & Tool Use benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
APEX-Agents—75.5%

Reasoning Claude Sonnet 5.5 leads

C4ai Aya Expanse 8b: 22.4 (#197), Claude Sonnet 5.5: 54.0 (#28)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Hard Prompts11561495
NYT Connections (extended)—80.5%
CritPt—31.4%
Mystery Game Puzzles—65%
Epoch Capabilities Index—165.03

Math Claude Sonnet 5.5 leads

C4ai Aya Expanse 8b: 33.3 (#203), Claude Sonnet 5.5: 87.9 (#6)

Math benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Math11681510
FrontierMath (Tiers 1-3)—88.8%
FrontierMath Tier 4—80.5%
OTIS Mock AIME 2024-2025—100%
ProofBench—100%
FrontierMath Erdős—2.9%

Knowledge Claude Sonnet 5.5 leads

C4ai Aya Expanse 8b: 33.6 (#201), Claude Sonnet 5.5: 66.0 (#12)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Expert11531540
GPQA Diamond—95.6%
SimpleQA Verified—46.5%
Vectara Hallucination Rate9.5%—

Multimodal Not comparable

C4ai Aya Expanse 8b: —, Claude Sonnet 5.5: 51.5 (#6)

Multimodal benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Vision—1289
Furniture Assembly—75%

Multilingual Claude Sonnet 5.5 leads

C4ai Aya Expanse 8b: 36.1 (#242), Claude Sonnet 5.5: 55.3 (#30)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Non-English11801452
LMArena Chinese11811522
LMArena Russian11971451
LMArena German1188—
LMArena Japanese1120—

Instruction Following Claude Sonnet 5.5 leads

C4ai Aya Expanse 8b: 60.1 (#253), Claude Sonnet 5.5: 78.3 (#11)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Instruction Following11551495

Long Context Claude Sonnet 5.5 leads

C4ai Aya Expanse 8b: 36.1 (#236), Claude Sonnet 5.5: 45.9 (#28)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Longer Query11911498

Writing & Preference Claude Sonnet 5.5 leads

C4ai Aya Expanse 8b: 39.0 (#250), Claude Sonnet 5.5: 66.0 (#40)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 8bClaude Sonnet 5.5
LMArena Text11851471
LMArena Creative Writing11681465
LMArena Multi-Turn11601474

Frequently asked questions

Is C4ai Aya Expanse 8b better than Claude Sonnet 5.5?

Claude Sonnet 5.5 is the stronger model overall, scoring 61.9 to 34.9 on the Noometry Index.

Is C4ai Aya Expanse 8b or Claude Sonnet 5.5 better for coding?

Claude Sonnet 5.5 scores higher on coding benchmarks: 67.3 versus 33.8 in the Noometry coding category.

How many benchmarks do C4ai Aya Expanse 8b and Claude Sonnet 5.5 share?

12 benchmarks have published results for both models. C4ai Aya Expanse 8b has 15 scored results on Noometry and Claude Sonnet 5.5 has 32.

Related comparisons

Go deeper