Model comparison

C4ai Aya Expanse 32b vs Gemma 3 4B

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 28.1 on the Noometry Index.

Last verified . 13 shared benchmarks.

C4ai Aya Expanse 32b Cohere

35.9

Rank #221 Confirmed

Gemma 3 4B Google

28.1

Rank #326 Confirmed

Summary

  • They share 13 benchmarks with published results for both. C4ai Aya Expanse 32b scores higher in 4 categories and Gemma 3 4B in 4 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in knowledge, where C4ai Aya Expanse 32b leads 33.2 to 11.8.
  • Gemma 3 4B accepts more context: 131K tokens versus 128K.

Side by side

C4ai Aya Expanse 32b and Gemma 3 4B specifications
C4ai Aya Expanse 32bGemma 3 4B
ProviderCohereGoogle
Noometry Index35.928.1
Released2024-10-242025-03-12
WeightsOpenOpen
Context window128K131K
Max output4K4K
Input $ / M tokens—$0.04
Output $ / M tokens—$0.08
Results tracked1822

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemma 3 4B leads

C4ai Aya Expanse 32b: 34.8 (#231), Gemma 3 4B: 35.9 (#215)

Coding benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
LMArena Coding11971230

Agentic & Tool Use Not comparable

C4ai Aya Expanse 32b: —, Gemma 3 4B: 20.9 (#142)

Agentic & Tool Use benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
Berkeley Function Calling Leaderboard—19.6%

Reasoning C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 23.3 (#180), Gemma 3 4B: 13.2 (#335)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
LMArena Hard Prompts11931253
Kagi LLM Benchmark—25.2%
Chess Puzzles—0%
DTBench—50.9%
LMCA—2.8%
Epoch Capabilities Index—116.02

Math C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 34.0 (#197), Gemma 3 4B: 16.8 (#292)

Math benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
LMArena Math12001239
OTIS Mock AIME 2024-2025—7.5%

Knowledge C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 33.2 (#206), Gemma 3 4B: 11.8 (#299)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
Vectara Hallucination Rate10.9%6.4%
LMArena Expert11821223
GPQA Diamond—23.2%

Multilingual Gemma 3 4B leads

C4ai Aya Expanse 32b: 38.4 (#230), Gemma 3 4B: 42.5 (#194)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
LMArena Non-English12131273
LMArena German11991281
LMArena Russian12271294
LMArena Chinese1211—
LMArena French1248—
LMArena Japanese1163—
LMArena Korean1158—
LMArena Spanish1193—

Instruction Following Gemma 3 4B leads

C4ai Aya Expanse 32b: 62.6 (#237), Gemma 3 4B: 65.2 (#225)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
LMArena Instruction Following11961239

Long Context Gemma 3 4B leads

C4ai Aya Expanse 32b: 37.2 (#220), Gemma 3 4B: 38.7 (#194)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
LMArena Longer Query12281273

Writing & Preference Too close to call

C4ai Aya Expanse 32b: 42.2 (#235), Gemma 3 4B: 42.0 (#239)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 3 4B
LMArena Text12241291
LMArena Creative Writing12001271
LMArena Multi-Turn11901255
EQ-Bench Creative Writing—1068

Frequently asked questions

Is C4ai Aya Expanse 32b better than Gemma 3 4B?

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 28.1 on the Noometry Index.

Is C4ai Aya Expanse 32b or Gemma 3 4B better for coding?

Gemma 3 4B scores higher on coding benchmarks: 35.9 versus 34.8 in the Noometry coding category.

Which has the bigger context window?

Gemma 3 4B does, with 131K tokens against 128K.

How many benchmarks do C4ai Aya Expanse 32b and Gemma 3 4B share?

13 benchmarks have published results for both models. C4ai Aya Expanse 32b has 18 scored results on Noometry and Gemma 3 4B has 22.

Related comparisons

Go deeper