Model comparison

C4ai Aya Expanse 32b vs Llama 13b

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 24.4 on the Noometry Index.

Last verified . 8 shared benchmarks.

C4ai Aya Expanse 32b Cohere

35.9

Rank #221 Confirmed

Llama 13b Meta

24.4

Rank #348 Confirmed

Summary

  • They share 8 benchmarks with published results for both. C4ai Aya Expanse 32b scores higher in 6 categories and Llama 13b in 0 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where C4ai Aya Expanse 32b leads 42.2 to 13.8.

Side by side

C4ai Aya Expanse 32b and Llama 13b specifications
C4ai Aya Expanse 32bLlama 13b
ProviderCohereMeta
Noometry Index35.924.4
Released2024-10-242023-02-24
WeightsOpenOpen
Context window128K—
Max output4K—
Input $ / M tokens——
Output $ / M tokens——
Results tracked1821

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 34.8 (#231), Llama 13b: 21.4 (#337)

Coding benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
LMArena Coding1197683

Reasoning C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 23.3 (#180), Llama 13b: 14.0 (#329)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
LMArena Hard Prompts1193728
BIG-Bench Hard—37.9%
Epoch Capabilities Index—100.58
HellaSwag—79.2%
LAMBADA—75.2%
PIQA—80.1%
WinoGrande—73%

Math C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 34.0 (#197), Llama 13b: 26.7 (#256)

Math benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
LMArena Math1200838
GSM8K—20.6%

Knowledge Not comparable

C4ai Aya Expanse 32b: 33.2 (#206), Llama 13b: —

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
Vectara Hallucination Rate10.9%—
LMArena Expert1182—
ARC (AI2) Challenge—52.7%
BoolQ—78.7%
MMLU—47.7%
OpenBookQA—56.4%
TriviaQA—77.9%

Multimodal Not comparable

C4ai Aya Expanse 32b: —, Llama 13b: —

Multimodal benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
ScienceQA—43.3%

Multilingual C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 38.4 (#230), Llama 13b: 16.6 (#297)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
LMArena Non-English1213819
LMArena Chinese1211—
LMArena French1248—
LMArena German1199—
LMArena Japanese1163—
LMArena Korean1158—
LMArena Russian1227—
LMArena Spanish1193—

Instruction Following C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 62.6 (#237), Llama 13b: 36.7 (#305)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
LMArena Instruction Following1196781

Long Context Not comparable

C4ai Aya Expanse 32b: 37.2 (#220), Llama 13b: —

Long Context benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
LMArena Longer Query1228—

Writing & Preference C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 42.2 (#235), Llama 13b: 13.8 (#312)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 13b
LMArena Text1224834
LMArena Creative Writing1200794
LMArena Multi-Turn1190753

Frequently asked questions

Is C4ai Aya Expanse 32b better than Llama 13b?

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 24.4 on the Noometry Index.

Is C4ai Aya Expanse 32b or Llama 13b better for coding?

C4ai Aya Expanse 32b scores higher on coding benchmarks: 34.8 versus 21.4 in the Noometry coding category.

How many benchmarks do C4ai Aya Expanse 32b and Llama 13b share?

8 benchmarks have published results for both models. C4ai Aya Expanse 32b has 18 scored results on Noometry and Llama 13b has 21.

Related comparisons

Go deeper