Model comparison

C4ai Aya Expanse 32b vs Llama 3.2 3B

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 28.9 on the Noometry Index.

Last verified . 13 shared benchmarks.

C4ai Aya Expanse 32b Cohere

35.9

Rank #221 Confirmed

Llama 3.2 3B Meta

28.9

Rank #321 Confirmed

Summary

  • They share 13 benchmarks with published results for both. C4ai Aya Expanse 32b scores higher in 8 categories and Llama 3.2 3B in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where C4ai Aya Expanse 32b leads 42.2 to 24.7.
  • Llama 3.2 3B accepts more context: 131K tokens versus 128K.

Side by side

C4ai Aya Expanse 32b and Llama 3.2 3B specifications
C4ai Aya Expanse 32bLlama 3.2 3B
ProviderCohereMeta
Noometry Index35.928.9
Released2024-10-242024-09-24
WeightsOpenOpen
Context window128K131K
Max output4K118K
Input $ / M tokens—$0.05
Output $ / M tokens—$0.33
Results tracked1818

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 34.8 (#231), Llama 3.2 3B: 27.6 (#319)

Coding benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
LMArena Coding11971098
BigCodeBench Instruct—23.4%
BigCodeBench Complete—28.3%

Agentic & Tool Use Not comparable

C4ai Aya Expanse 32b: —, Llama 3.2 3B: 20.1 (#143)

Agentic & Tool Use benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
Berkeley Function Calling Leaderboard—21.9%
BALROG—10.1%

Reasoning C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 23.3 (#180), Llama 3.2 3B: 21.0 (#228)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
LMArena Hard Prompts11931095

Math C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 34.0 (#197), Llama 3.2 3B: 32.4 (#214)

Math benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
LMArena Math12001126

Knowledge C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 33.2 (#206), Llama 3.2 3B: 29.7 (#235)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
LMArena Expert11821090
Vectara Hallucination Rate10.9%—

Multilingual C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 38.4 (#230), Llama 3.2 3B: 26.2 (#281)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
LMArena Non-English12131019
LMArena Chinese12111017
LMArena German11991056
LMArena Russian1227949
LMArena French1248—
LMArena Japanese1163—
LMArena Korean1158—
LMArena Spanish1193—

Instruction Following C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 62.6 (#237), Llama 3.2 3B: 56.0 (#275)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
LMArena Instruction Following11961089

Long Context C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 37.2 (#220), Llama 3.2 3B: 33.4 (#261)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
LMArena Longer Query12281100

Writing & Preference C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 42.2 (#235), Llama 3.2 3B: 24.7 (#307)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.2 3B
LMArena Text12241110
LMArena Creative Writing12001094
LMArena Multi-Turn11901105
EQ-Bench Creative Writing—595

Frequently asked questions

Is C4ai Aya Expanse 32b better than Llama 3.2 3B?

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 28.9 on the Noometry Index.

Is C4ai Aya Expanse 32b or Llama 3.2 3B better for coding?

C4ai Aya Expanse 32b scores higher on coding benchmarks: 34.8 versus 27.6 in the Noometry coding category.

Which has the bigger context window?

Llama 3.2 3B does, with 131K tokens against 128K.

How many benchmarks do C4ai Aya Expanse 32b and Llama 3.2 3B share?

13 benchmarks have published results for both models. C4ai Aya Expanse 32b has 18 scored results on Noometry and Llama 3.2 3B has 18.

Related comparisons

Go deeper