Model comparison

C4ai Aya Expanse 32b vs Gemma 2 27B

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 29.4 on the Noometry Index.

Last verified . 17 shared benchmarks.

C4ai Aya Expanse 32b Cohere

35.9

Rank #221 Confirmed

Gemma 2 27B Google

29.4

Rank #312 Confirmed

Summary

  • They share 17 benchmarks with published results for both. C4ai Aya Expanse 32b scores higher in 5 categories and Gemma 2 27B in 3 categories; 5 gaps are clear of the uncertainty.
  • The widest gap is in math, where C4ai Aya Expanse 32b leads 34.0 to 10.7.
  • C4ai Aya Expanse 32b accepts more context: 128K tokens versus 8K.

Side by side

C4ai Aya Expanse 32b and Gemma 2 27B specifications
C4ai Aya Expanse 32bGemma 2 27B
ProviderCohereGoogle
Noometry Index35.929.4
Released2024-10-242024-06-24
WeightsOpenOpen
Context window128K8K
Max output4K2K
Input $ / M tokens—$0.65
Output $ / M tokens—$0.65
Results tracked1834

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

C4ai Aya Expanse 32b: 34.8 (#231), Gemma 2 27B: 34.1 (#246)

Coding benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 2 27B
LMArena Coding11971211
BigCodeBench Instruct—42.8%
LiveBench Coding—36%
BigCodeBench Complete—52.5%

Reasoning C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 23.3 (#180), Gemma 2 27B: 15.3 (#315)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 2 27B
LMArena Hard Prompts11931198
LiveBench Reasoning—28.1%
DTBench—48%
LiveBench Data Analysis—47.9%
LMCA—7.1%
Epoch Capabilities Index—122.08
LiveBench—38.2%

Math C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 34.0 (#197), Gemma 2 27B: 10.7 (#311)

Math benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 2 27B
LMArena Math12001212
OTIS Mock AIME 2024-2025—1.4%
LiveBench Math—26.5%
MATH Level 5—27.9%

Knowledge C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 33.2 (#206), Gemma 2 27B: 19.0 (#280)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 2 27B
LMArena Expert11821172
GPQA Diamond—36.5%
Confabulations—27.1%
Vectara Hallucination Rate10.9%—
MMLU—75.7%

Multilingual Too close to call

C4ai Aya Expanse 32b: 38.4 (#230), Gemma 2 27B: 38.6 (#226)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 2 27B
LMArena Non-English12131217
LMArena Chinese12111221
LMArena French12481247
LMArena German11991209
LMArena Japanese11631175
LMArena Korean11581174
LMArena Russian12271234
LMArena Spanish11931228

Instruction Following C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 62.6 (#237), Gemma 2 27B: 60.5 (#249)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 2 27B
LMArena Instruction Following11961206
LiveBench Instruction Following—58.1%

Long Context Too close to call

C4ai Aya Expanse 32b: 37.2 (#220), Gemma 2 27B: 37.3 (#218)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 2 27B
LMArena Longer Query12281231

Writing & Preference Gemma 2 27B leads

C4ai Aya Expanse 32b: 42.2 (#235), Gemma 2 27B: 44.2 (#225)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 32bGemma 2 27B
LMArena Text12241231
LMArena Creative Writing12001241
LMArena Multi-Turn11901224
LiveBench Language—32.6%

Frequently asked questions

Is C4ai Aya Expanse 32b better than Gemma 2 27B?

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 29.4 on the Noometry Index.

Is C4ai Aya Expanse 32b or Gemma 2 27B better for coding?

They score almost the same on coding (34.8 vs 34.1); test both on your own repository before choosing.

Which has the bigger context window?

C4ai Aya Expanse 32b does, with 128K tokens against 8K.

How many benchmarks do C4ai Aya Expanse 32b and Gemma 2 27B share?

17 benchmarks have published results for both models. C4ai Aya Expanse 32b has 18 scored results on Noometry and Gemma 2 27B has 34.

Related comparisons

Go deeper