Model comparison

C4ai Aya Expanse 8b vs Chatgpt 4o Latest 20250326

Chatgpt 4o Latest 20250326 is the stronger model overall, scoring 43.8 to 34.9 on the Noometry Index.

Last verified . 14 shared benchmarks.

C4ai Aya Expanse 8b Cohere

34.9

Rank #229 Confirmed

Chatgpt 4o Latest 20250326 OpenAI

43.8

Rank #82 Confirmed

Summary

  • They share 14 benchmarks with published results for both. C4ai Aya Expanse 8b scores higher in 0 categories and Chatgpt 4o Latest 20250326 in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Chatgpt 4o Latest 20250326 leads 62.6 to 39.0.
  • C4ai Aya Expanse 8b has downloadable open weights; the other is API-only.

Side by side

C4ai Aya Expanse 8b and Chatgpt 4o Latest 20250326 specifications
C4ai Aya Expanse 8bChatgpt 4o Latest 20250326
ProviderCohereOpenAI
Noometry Index34.943.8
Released——
WeightsOpenProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked1521

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Chatgpt 4o Latest 20250326 leads

C4ai Aya Expanse 8b: 33.8 (#252), Chatgpt 4o Latest 20250326: 41.6 (#122)

Coding benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Coding11601413

Reasoning Chatgpt 4o Latest 20250326 leads

C4ai Aya Expanse 8b: 22.4 (#197), Chatgpt 4o Latest 20250326: 33.8 (#71)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Hard Prompts11561424
Kagi LLM Benchmark—75%

Math Chatgpt 4o Latest 20250326 leads

C4ai Aya Expanse 8b: 33.3 (#203), Chatgpt 4o Latest 20250326: 38.6 (#134)

Math benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Math11681407

Knowledge Chatgpt 4o Latest 20250326 leads

C4ai Aya Expanse 8b: 33.6 (#201), Chatgpt 4o Latest 20250326: 39.2 (#137)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Expert11531401
Confabulations—16.6%
Vectara Hallucination Rate9.5%—

Multimodal Not comparable

C4ai Aya Expanse 8b: —, Chatgpt 4o Latest 20250326: 39.6 (#58)

Multimodal benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Vision—1243

Multilingual Chatgpt 4o Latest 20250326 leads

C4ai Aya Expanse 8b: 36.1 (#242), Chatgpt 4o Latest 20250326: 52.9 (#76)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Non-English11801419
LMArena Chinese11811457
LMArena German11881423
LMArena Japanese11201405
LMArena Russian11971429
LMArena French—1446
LMArena Korean—1396
LMArena Spanish—1434

Instruction Following Chatgpt 4o Latest 20250326 leads

C4ai Aya Expanse 8b: 60.1 (#253), Chatgpt 4o Latest 20250326: 74.0 (#107)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Instruction Following11551403

Long Context Chatgpt 4o Latest 20250326 leads

C4ai Aya Expanse 8b: 36.1 (#236), Chatgpt 4o Latest 20250326: 43.1 (#107)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Longer Query11911413

Writing & Preference Chatgpt 4o Latest 20250326 leads

C4ai Aya Expanse 8b: 39.0 (#250), Chatgpt 4o Latest 20250326: 62.6 (#72)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 8bChatgpt 4o Latest 20250326
LMArena Text11851429
LMArena Creative Writing11681405
LMArena Multi-Turn11601454
EQ-Bench Creative Writing—1501

Frequently asked questions

Is C4ai Aya Expanse 8b better than Chatgpt 4o Latest 20250326?

Chatgpt 4o Latest 20250326 is the stronger model overall, scoring 43.8 to 34.9 on the Noometry Index.

Is C4ai Aya Expanse 8b or Chatgpt 4o Latest 20250326 better for coding?

Chatgpt 4o Latest 20250326 scores higher on coding benchmarks: 41.6 versus 33.8 in the Noometry coding category.

How many benchmarks do C4ai Aya Expanse 8b and Chatgpt 4o Latest 20250326 share?

14 benchmarks have published results for both models. C4ai Aya Expanse 8b has 15 scored results on Noometry and Chatgpt 4o Latest 20250326 has 21.

Related comparisons

Go deeper