Model comparison

C4ai Aya Expanse 8b vs Qwen3 8B

C4ai Aya Expanse 8b is the stronger model overall, scoring 34.9 to 33.7 on the Noometry Index.

Last verified . 1 shared benchmarks.

C4ai Aya Expanse 8b Cohere

34.9

Rank #229 Confirmed

Qwen3 8B Alibaba (Qwen)

33.7

Rank #238 Confirmed

Summary

  • They share 1 benchmark with published results for both. C4ai Aya Expanse 8b scores higher in 1 category and Qwen3 8B in 4 categories; 4 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where C4ai Aya Expanse 8b leads 22.4 to 16.6.

Side by side

C4ai Aya Expanse 8b and Qwen3 8B specifications
C4ai Aya Expanse 8bQwen3 8B
ProviderCohereAlibaba (Qwen)
Noometry Index34.933.7
Released—2025-04
WeightsOpenOpen
Context window—131K
Max output—8K
Input $ / M tokens—$0.18
Output $ / M tokens—$0.70
Results tracked1511

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

C4ai Aya Expanse 8b: 33.8 (#252), Qwen3 8B: 34.0 (#248)

Coding benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
SciCode—22.6%
LMArena Coding1160—

Agentic & Tool Use Not comparable

C4ai Aya Expanse 8b: —, Qwen3 8B: 30.2 (#78)

Agentic & Tool Use benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
Berkeley Function Calling Leaderboard—42.6%

Reasoning C4ai Aya Expanse 8b leads

C4ai Aya Expanse 8b: 22.4 (#197), Qwen3 8B: 16.6 (#303)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
CritPt—0%
Chess Puzzles—5%
LMArena Hard Prompts1156—
DTBench—59.7%
LMCA—8.8%
Epoch Capabilities Index—136.17

Math Qwen3 8B leads

C4ai Aya Expanse 8b: 33.3 (#203), Qwen3 8B: 34.9 (#191)

Math benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
OTIS Mock AIME 2024-2025—56.1%
LMArena Math1168—

Knowledge Qwen3 8B leads

C4ai Aya Expanse 8b: 33.6 (#201), Qwen3 8B: 36.1 (#173)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
Vectara Hallucination Rate9.5%4.8%
GPQA Diamond—56.8%
LMArena Expert1153—

Multilingual Not comparable

C4ai Aya Expanse 8b: 36.1 (#242), Qwen3 8B: —

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
LMArena Non-English1180—
LMArena Chinese1181—
LMArena German1188—
LMArena Japanese1120—
LMArena Russian1197—

Instruction Following Not comparable

C4ai Aya Expanse 8b: 60.1 (#253), Qwen3 8B: —

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
LMArena Instruction Following1155—

Long Context Qwen3 8B leads

C4ai Aya Expanse 8b: 36.1 (#236), Qwen3 8B: 37.9 (#210)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
Fiction.LiveBench—62.1%
LMArena Longer Query1191—

Writing & Preference Not comparable

C4ai Aya Expanse 8b: 39.0 (#250), Qwen3 8B: —

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 8bQwen3 8B
LMArena Text1185—
LMArena Creative Writing1168—
LMArena Multi-Turn1160—

Frequently asked questions

Is C4ai Aya Expanse 8b better than Qwen3 8B?

C4ai Aya Expanse 8b is the stronger model overall, scoring 34.9 to 33.7 on the Noometry Index.

Is C4ai Aya Expanse 8b or Qwen3 8B better for coding?

They score almost the same on coding (33.8 vs 34.0); test both on your own repository before choosing.

How many benchmarks do C4ai Aya Expanse 8b and Qwen3 8B share?

1 benchmark has published results for both models. C4ai Aya Expanse 8b has 15 scored results on Noometry and Qwen3 8B has 11.

Related comparisons

Go deeper