Model comparison

Command A vs Gemma 2 2b IT

Command A is the stronger model overall, scoring 36.5 to 33.1 on the Noometry Index.

Last verified . 17 shared benchmarks.

Command A Cohere

36.5

Rank #215 Confirmed

Gemma 2 2b IT Google

33.1

Rank #248 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Command A scores higher in 6 categories and Gemma 2 2b IT in 2 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in multilingual, where Command A leads 45.3 to 32.3.

Side by side

Command A and Gemma 2 2b IT specifications
Command AGemma 2 2b IT
ProviderCohereGoogle
Noometry Index36.533.1
Released2025-03-13—
WeightsOpenOpen
Context window256K—
Max output8K—
Input $ / M tokens$2.50—
Output $ / M tokens$10—
Results tracked2417

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemma 2 2b IT leads

Command A: 27.2 (#322), Gemma 2 2b IT: 32.3 (#273)

Coding benchmarks
BenchmarkCommand AGemma 2 2b IT
LMArena Coding13301112
Aider Polyglot12%—

Agentic & Tool Use Not comparable

Command A: 35.9 (#40), Gemma 2 2b IT: —

Agentic & Tool Use benchmarks
BenchmarkCommand AGemma 2 2b IT
Berkeley Function Calling Leaderboard57.1%—

Reasoning Gemma 2 2b IT leads

Command A: 18.3 (#283), Gemma 2 2b IT: 21.4 (#224)

Reasoning benchmarks
BenchmarkCommand AGemma 2 2b IT
LMArena Hard Prompts13261113
Kagi LLM Benchmark28.8%—
DTBench61.3%—
LMCA10.3%—

Math Command A leads

Command A: 36.2 (#171), Gemma 2 2b IT: 32.6 (#212)

Math benchmarks
BenchmarkCommand AGemma 2 2b IT
LMArena Math13001135

Knowledge Command A leads

Command A: 37.1 (#159), Gemma 2 2b IT: 29.9 (#231)

Knowledge benchmarks
BenchmarkCommand AGemma 2 2b IT
LMArena Expert12951096
Vectara Hallucination Rate9.3%—

Multilingual Command A leads

Command A: 45.3 (#170), Gemma 2 2b IT: 32.3 (#257)

Multilingual benchmarks
BenchmarkCommand AGemma 2 2b IT
LMArena Non-English13131121
LMArena Chinese13271132
LMArena French13511157
LMArena German13411114
LMArena Japanese12851083
LMArena Korean12851055
LMArena Russian13141118
LMArena Spanish13471140

Instruction Following Command A leads

Command A: 69.1 (#177), Gemma 2 2b IT: 57.8 (#263)

Instruction Following benchmarks
BenchmarkCommand AGemma 2 2b IT
LMArena Instruction Following13091118

Long Context Command A leads

Command A: 40.6 (#151), Gemma 2 2b IT: 34.3 (#250)

Long Context benchmarks
BenchmarkCommand AGemma 2 2b IT
LMArena Longer Query13341130

Writing & Preference Command A leads

Command A: 47.6 (#208), Gemma 2 2b IT: 36.5 (#263)

Writing & Preference benchmarks
BenchmarkCommand AGemma 2 2b IT
LMArena Text13311156
LMArena Creative Writing13191147
LMArena Multi-Turn13391118
EQ-Bench Creative Writing1145—

Frequently asked questions

Is Command A better than Gemma 2 2b IT?

Command A is the stronger model overall, scoring 36.5 to 33.1 on the Noometry Index.

Is Command A or Gemma 2 2b IT better for coding?

Gemma 2 2b IT scores higher on coding benchmarks: 32.3 versus 27.2 in the Noometry coding category.

How many benchmarks do Command A and Gemma 2 2b IT share?

17 benchmarks have published results for both models. Command A has 24 scored results on Noometry and Gemma 2 2b IT has 17.

Related comparisons

Go deeper