Model comparison

C4ai Aya Expanse 32b vs Llama 3.3 Nemotron 49b Super v1

Llama 3.3 Nemotron 49b Super v1 is the stronger model overall, scoring 40.1 to 35.9 on the Noometry Index.

Last verified . 10 shared benchmarks.

C4ai Aya Expanse 32b Cohere

35.9

Rank #221 Confirmed

Summary

  • They share 10 benchmarks with published results for both. C4ai Aya Expanse 32b scores higher in 0 categories and Llama 3.3 Nemotron 49b Super v1 in 6 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Llama 3.3 Nemotron 49b Super v1 leads 50.8 to 42.2.

Side by side

C4ai Aya Expanse 32b and Llama 3.3 Nemotron 49b Super v1 specifications
C4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
ProviderCohereNVIDIA
Noometry Index35.940.1
Released2024-10-24—
WeightsOpenOpen
Context window128K—
Max output4K—
Input $ / M tokens——
Output $ / M tokens——
Results tracked1810

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Llama 3.3 Nemotron 49b Super v1 leads

C4ai Aya Expanse 32b: 34.8 (#231), Llama 3.3 Nemotron 49b Super v1: 37.9 (#186)

Coding benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
LMArena Coding11971296

Reasoning Llama 3.3 Nemotron 49b Super v1 leads

C4ai Aya Expanse 32b: 23.3 (#180), Llama 3.3 Nemotron 49b Super v1: 26.2 (#135)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
LMArena Hard Prompts11931311

Math Not comparable

C4ai Aya Expanse 32b: 34.0 (#197), Llama 3.3 Nemotron 49b Super v1: —

Math benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
LMArena Math1200—

Knowledge Not comparable

C4ai Aya Expanse 32b: 33.2 (#206), Llama 3.3 Nemotron 49b Super v1: —

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
Vectara Hallucination Rate10.9%—
LMArena Expert1182—

Multilingual Llama 3.3 Nemotron 49b Super v1 leads

C4ai Aya Expanse 32b: 38.4 (#230), Llama 3.3 Nemotron 49b Super v1: 41.1 (#211)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
LMArena Non-English12131253
LMArena Chinese12111277
LMArena Russian12271269
LMArena French1248—
LMArena German1199—
LMArena Japanese1163—
LMArena Korean1158—
LMArena Spanish1193—

Instruction Following Llama 3.3 Nemotron 49b Super v1 leads

C4ai Aya Expanse 32b: 62.6 (#237), Llama 3.3 Nemotron 49b Super v1: 68.3 (#189)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
LMArena Instruction Following11961293

Long Context Llama 3.3 Nemotron 49b Super v1 leads

C4ai Aya Expanse 32b: 37.2 (#220), Llama 3.3 Nemotron 49b Super v1: 39.5 (#176)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
LMArena Longer Query12281299

Writing & Preference Llama 3.3 Nemotron 49b Super v1 leads

C4ai Aya Expanse 32b: 42.2 (#235), Llama 3.3 Nemotron 49b Super v1: 50.8 (#179)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 32bLlama 3.3 Nemotron 49b Super v1
LMArena Text12241308
LMArena Creative Writing12001288
LMArena Multi-Turn11901315

Frequently asked questions

Is C4ai Aya Expanse 32b better than Llama 3.3 Nemotron 49b Super v1?

Llama 3.3 Nemotron 49b Super v1 is the stronger model overall, scoring 40.1 to 35.9 on the Noometry Index.

Is C4ai Aya Expanse 32b or Llama 3.3 Nemotron 49b Super v1 better for coding?

Llama 3.3 Nemotron 49b Super v1 scores higher on coding benchmarks: 37.9 versus 34.8 in the Noometry coding category.

How many benchmarks do C4ai Aya Expanse 32b and Llama 3.3 Nemotron 49b Super v1 share?

10 benchmarks have published results for both models. C4ai Aya Expanse 32b has 18 scored results on Noometry and Llama 3.3 Nemotron 49b Super v1 has 10.

Related comparisons

Go deeper