Model comparison

C4ai Aya Expanse 32b vs Mistral 7B

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 23.0 on the Noometry Index.

Last verified . 16 shared benchmarks.

C4ai Aya Expanse 32b Cohere

35.9

Rank #221 Confirmed

Mistral 7B Mistral AI

23.0

Rank #351 Confirmed

Summary

  • They share 16 benchmarks with published results for both. C4ai Aya Expanse 32b scores higher in 8 categories and Mistral 7B in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where C4ai Aya Expanse 32b leads 34.0 to 8.1.
  • C4ai Aya Expanse 32b accepts more context: 128K tokens versus 8K.

Side by side

C4ai Aya Expanse 32b and Mistral 7B specifications
C4ai Aya Expanse 32bMistral 7B
ProviderCohereMistral AI
Noometry Index35.923.0
Released2024-10-242023-09-27
WeightsOpenOpen
Context window128K8K
Max output4K8K
Input $ / M tokens—$0.25
Output $ / M tokens—$0.25
Results tracked1837

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 34.8 (#231), Mistral 7B: 26.4 (#326)

Coding benchmarks
BenchmarkC4ai Aya Expanse 32bMistral 7B
LMArena Coding11971082
BigCodeBench Instruct—19.5%
BigCodeBench Complete—27.3%
HumanEval+—36%
MBPP+—42.1%

Reasoning C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 23.3 (#180), Mistral 7B: 13.1 (#336)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 32bMistral 7B
LMArena Hard Prompts11931067
Chess Puzzles—0%
DTBench—42.5%
Adversarial NLI—47.1%
BIG-Bench Hard—56.1%
Epoch Capabilities Index—112.21
HellaSwag—81%
PIQA—83%
WinoGrande—75.3%

Math C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 34.0 (#197), Mistral 7B: 8.1 (#325)

Math benchmarks
BenchmarkC4ai Aya Expanse 32bMistral 7B
LMArena Math12001085
OTIS Mock AIME 2024-2025—0.3%
MATH Level 5—3.7%
GSM8K—54.4%

Knowledge C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 33.2 (#206), Mistral 7B: 7.4 (#311)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 32bMistral 7B
LMArena Expert11821036
GPQA Diamond—15.2%
Vectara Hallucination Rate10.9%—
ARC (AI2) Challenge—78.6%
BoolQ—87.4%
MMLU—62.5%
OpenBookQA—79.8%
TriviaQA—75.2%

Multilingual C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 38.4 (#230), Mistral 7B: 25.8 (#283)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 32bMistral 7B
LMArena Non-English12131012
LMArena Chinese12111009
LMArena French12481037
LMArena German1199987
LMArena Japanese1163878
LMArena Russian12271018
LMArena Spanish11931026
LMArena Korean1158—

Instruction Following C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 62.6 (#237), Mistral 7B: 54.2 (#280)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 32bMistral 7B
LMArena Instruction Following11961060

Long Context C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 37.2 (#220), Mistral 7B: 32.2 (#271)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 32bMistral 7B
LMArena Longer Query12281060

Writing & Preference C4ai Aya Expanse 32b leads

C4ai Aya Expanse 32b: 42.2 (#235), Mistral 7B: 30.7 (#286)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 32bMistral 7B
LMArena Text12241090
LMArena Creative Writing12001068
LMArena Multi-Turn11901062

Frequently asked questions

Is C4ai Aya Expanse 32b better than Mistral 7B?

C4ai Aya Expanse 32b is the stronger model overall, scoring 35.9 to 23.0 on the Noometry Index.

Is C4ai Aya Expanse 32b or Mistral 7B better for coding?

C4ai Aya Expanse 32b scores higher on coding benchmarks: 34.8 versus 26.4 in the Noometry coding category.

Which has the bigger context window?

C4ai Aya Expanse 32b does, with 128K tokens against 8K.

How many benchmarks do C4ai Aya Expanse 32b and Mistral 7B share?

16 benchmarks have published results for both models. C4ai Aya Expanse 32b has 18 scored results on Noometry and Mistral 7B has 37.

Related comparisons

Go deeper