Model comparison

C4ai Aya Expanse 32b vs Codellama 70b Instruct

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 33.7 on the Noometry Index.

Last verified . 4 shared benchmarks.

C4ai Aya Expanse 32b Cohere

35.9

Rank #221 Confirmed

Codellama 70b Instruct Meta

33.7

Rank #237 Confirmed

Summary

  • They share 4 benchmarks with published results for both. C4ai Aya Expanse 32b scores higher in 4 categories and Codellama 70b Instruct in 1 category; 5 gaps are clear of the uncertainty.
  • The widest gap is in multilingual, where C4ai Aya Expanse 32b leads 38.4 to 24.8.

Side by side

C4ai Aya Expanse 32b and Codellama 70b Instruct specifications
C4ai Aya Expanse 32bCodellama 70b Instruct
ProviderCohereMeta
Noometry Index35.933.7
Released2024-10-24—
WeightsOpenOpen
Context window128K—
Max output4K—
Input $ / M tokens——
Output $ / M tokens——
Results tracked187

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Codellama 70b Instruct leads

C4ai Aya Expanse 32b: 34.8 (#231), Codellama 70b Instruct: 37.6 (#193)

Coding benchmarks
BenchmarkC4ai Aya Expanse 32bCodellama 70b Instruct
BigCodeBench Instruct—40.7%
LMArena Coding1197—
BigCodeBench Complete—49.6%
HumanEval+—65.9%

Reasoning C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 23.3 (#180), Codellama 70b Instruct: 20.1 (#242)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 32bCodellama 70b Instruct
LMArena Hard Prompts11931052

Math Not comparable

C4ai Aya Expanse 32b: 34.0 (#197), Codellama 70b Instruct: —

Math benchmarks
BenchmarkC4ai Aya Expanse 32bCodellama 70b Instruct
LMArena Math1200—

Knowledge Not comparable

C4ai Aya Expanse 32b: 33.2 (#206), Codellama 70b Instruct: —

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 32bCodellama 70b Instruct
Vectara Hallucination Rate10.9%—
LMArena Expert1182—

Multilingual C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 38.4 (#230), Codellama 70b Instruct: 24.8 (#288)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 32bCodellama 70b Instruct
LMArena Non-English1213992
LMArena Chinese1211—
LMArena French1248—
LMArena German1199—
LMArena Japanese1163—
LMArena Korean1158—
LMArena Russian1227—
LMArena Spanish1193—

Instruction Following C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 62.6 (#237), Codellama 70b Instruct: 51.9 (#293)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 32bCodellama 70b Instruct
LMArena Instruction Following11961024

Long Context Not comparable

C4ai Aya Expanse 32b: 37.2 (#220), Codellama 70b Instruct: —

Long Context benchmarks
BenchmarkC4ai Aya Expanse 32bCodellama 70b Instruct
LMArena Longer Query1228—

Writing & Preference C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 42.2 (#235), Codellama 70b Instruct: 33.4 (#277)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 32bCodellama 70b Instruct
LMArena Text12241057
LMArena Creative Writing1200—
LMArena Multi-Turn1190—

Frequently asked questions

Is C4ai Aya Expanse 32b better than Codellama 70b Instruct?

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 33.7 on the Noometry Index.

Is C4ai Aya Expanse 32b or Codellama 70b Instruct better for coding?

Codellama 70b Instruct scores higher on coding benchmarks: 37.6 versus 34.8 in the Noometry coding category.

How many benchmarks do C4ai Aya Expanse 32b and Codellama 70b Instruct share?

4 benchmarks have published results for both models. C4ai Aya Expanse 32b has 18 scored results on Noometry and Codellama 70b Instruct has 7.

Related comparisons

Go deeper