Model comparison

C4ai Aya Expanse 32b vs Kimi K2.7 Code

Kimi K2.7 Code is the stronger model overall, scoring 43.3 to 35.9 on the Noometry Index.

Last verified . 0 shared benchmarks.

C4ai Aya Expanse 32b Cohere

35.9

Rank #221 Confirmed

Kimi K2.7 Code Moonshot AI

43.3

Rank #94 Confirmed

Summary

  • The widest gap is in knowledge, where Kimi K2.7 Code leads 53.5 to 33.2.
  • Kimi K2.7 Code accepts more context: 262K tokens versus 128K.

Side by side

C4ai Aya Expanse 32b and Kimi K2.7 Code specifications
C4ai Aya Expanse 32bKimi K2.7 Code
ProviderCohereMoonshot AI
Noometry Index35.943.3
Released2024-10-242026-06-12
WeightsOpenOpen
Context window128K262K
Max output4K262K
Input $ / M tokens—$0.95
Output $ / M tokens—$4
Results tracked1819

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Kimi K2.7 Code leads

C4ai Aya Expanse 32b: 34.8 (#231), Kimi K2.7 Code: 42.9 (#95)

Coding benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
DeepSWE—30.5%
FrontierCode—30.1%
LMArena WebDev—1473
SciCode—47.5%
WeirdML—54.1%
LMArena Coding1197—
ALE-Bench—886.23

Agentic & Tool Use Not comparable

C4ai Aya Expanse 32b: —, Kimi K2.7 Code: 24.0 (#122)

Agentic & Tool Use benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
APEX-Agents—37.6%
GBAEval—0.9%
Vending-Bench 2—5,083

Reasoning Kimi K2.7 Code leads

C4ai Aya Expanse 32b: 23.3 (#180), Kimi K2.7 Code: 39.0 (#61)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
SimpleBench—57.9%
CritPt—10%
Chess Puzzles—21%
LMArena Hard Prompts1193—
Surface Evolver Bench—48.8%
Epoch Capabilities Index—149.97

Math Kimi K2.7 Code leads

C4ai Aya Expanse 32b: 34.0 (#197), Kimi K2.7 Code: 52.9 (#48)

Math benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
FrontierMath (Tiers 1-3)—54%
FrontierMath Tier 4—12.2%
OTIS Mock AIME 2024-2025—95.6%
LMArena Math1200—

Knowledge Kimi K2.7 Code leads

C4ai Aya Expanse 32b: 33.2 (#206), Kimi K2.7 Code: 53.5 (#57)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
GPQA Diamond—87.9%
SimpleQA Verified—36.5%
Vectara Hallucination Rate10.9%—
LMArena Expert1182—

Multilingual Not comparable

C4ai Aya Expanse 32b: 38.4 (#230), Kimi K2.7 Code: —

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
LMArena Non-English1213—
LMArena Chinese1211—
LMArena French1248—
LMArena German1199—
LMArena Japanese1163—
LMArena Korean1158—
LMArena Russian1227—
LMArena Spanish1193—

Instruction Following Not comparable

C4ai Aya Expanse 32b: 62.6 (#237), Kimi K2.7 Code: —

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
LMArena Instruction Following1196—

Long Context Not comparable

C4ai Aya Expanse 32b: 37.2 (#220), Kimi K2.7 Code: —

Long Context benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
LMArena Longer Query1228—

Writing & Preference Not comparable

C4ai Aya Expanse 32b: 42.2 (#235), Kimi K2.7 Code: —

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 32bKimi K2.7 Code
LMArena Text1224—
LMArena Creative Writing1200—
LMArena Multi-Turn1190—

Frequently asked questions

Is C4ai Aya Expanse 32b better than Kimi K2.7 Code?

Kimi K2.7 Code is the stronger model overall, scoring 43.3 to 35.9 on the Noometry Index.

Is C4ai Aya Expanse 32b or Kimi K2.7 Code better for coding?

Kimi K2.7 Code scores higher on coding benchmarks: 42.9 versus 34.8 in the Noometry coding category.

Which has the bigger context window?

Kimi K2.7 Code does, with 262K tokens against 128K.

How many benchmarks do C4ai Aya Expanse 32b and Kimi K2.7 Code share?

0 benchmarks have published results for both models. C4ai Aya Expanse 32b has 18 scored results on Noometry and Kimi K2.7 Code has 19.

Related comparisons

Go deeper