Model comparison

Command A vs Gemini 4 Argon

Gemini 4 Argon is the stronger model overall, scoring 56.5 to 36.5 on the Noometry Index.

Last verified . 13 shared benchmarks.

Command A Cohere

36.5

Rank #215 Confirmed

Gemini 4 Argon Google

56.5

Rank #24 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Command A scores higher in 0 categories and Gemini 4 Argon in 9 categories; 9 gaps are clear of the uncertainty.
  • The widest gap is in math, where Gemini 4 Argon leads 73.9 to 36.2.
  • Command A has downloadable open weights; the other is API-only.

Side by side

Command A and Gemini 4 Argon specifications
Command AGemini 4 Argon
ProviderCohereGoogle
Noometry Index36.556.5
Released2025-03-132026-09-30
WeightsOpenProprietary
Context window256K—
Max output8K—
Input $ / M tokens$2.50—
Output $ / M tokens$10—
Results tracked2421

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemini 4 Argon leads

Command A: 27.2 (#322), Gemini 4 Argon: 62.0 (#9)

Coding benchmarks
BenchmarkCommand AGemini 4 Argon
LMArena Coding13301550
Aider Polyglot12%—
LMArena WebDev—1678
FrontierSWE—55%
SciCode—61.8%

Agentic & Tool Use Gemini 4 Argon leads

Command A: 35.9 (#40), Gemini 4 Argon: 49.2 (#8)

Agentic & Tool Use benchmarks
BenchmarkCommand AGemini 4 Argon
APEX-Agents—82.2%
Berkeley Function Calling Leaderboard57.1%—
Vending-Bench 2—13,718

Reasoning Gemini 4 Argon leads

Command A: 18.3 (#283), Gemini 4 Argon: 44.2 (#47)

Reasoning benchmarks
BenchmarkCommand AGemini 4 Argon
LMArena Hard Prompts13261548
Kagi LLM Benchmark28.8%—
CritPt—27.1%
DTBench61.3%—
LMCA10.3%—

Math Gemini 4 Argon leads

Command A: 36.2 (#171), Gemini 4 Argon: 73.9 (#17)

Math benchmarks
BenchmarkCommand AGemini 4 Argon
LMArena Math13001536
ProofBench—99%

Knowledge Gemini 4 Argon leads

Command A: 37.1 (#159), Gemini 4 Argon: 43.9 (#89)

Knowledge benchmarks
BenchmarkCommand AGemini 4 Argon
LMArena Expert12951553
Vectara Hallucination Rate9.3%—

Multimodal Not comparable

Command A: —, Gemini 4 Argon: 46.5 (#14)

Multimodal benchmarks
BenchmarkCommand AGemini 4 Argon
Blueprint-Bench 2—54.4%

Multilingual Gemini 4 Argon leads

Command A: 45.3 (#170), Gemini 4 Argon: 60.3 (#1)

Multilingual benchmarks
BenchmarkCommand AGemini 4 Argon
LMArena Non-English13131523
LMArena Chinese13271610
LMArena Russian13141537
LMArena Spanish13471497
LMArena French1351—
LMArena German1341—
LMArena Japanese1285—
LMArena Korean1285—

Instruction Following Gemini 4 Argon leads

Command A: 69.1 (#177), Gemini 4 Argon: 80.1 (#2)

Instruction Following benchmarks
BenchmarkCommand AGemini 4 Argon
LMArena Instruction Following13091538

Long Context Gemini 4 Argon leads

Command A: 40.6 (#151), Gemini 4 Argon: 47.6 (#15)

Long Context benchmarks
BenchmarkCommand AGemini 4 Argon
LMArena Longer Query13341549

Writing & Preference Gemini 4 Argon leads

Command A: 47.6 (#208), Gemini 4 Argon: 71.4 (#19)

Writing & Preference benchmarks
BenchmarkCommand AGemini 4 Argon
LMArena Text13311534
LMArena Creative Writing13191531
LMArena Multi-Turn13391557
EQ-Bench Creative Writing1145—

Frequently asked questions

Is Command A better than Gemini 4 Argon?

Gemini 4 Argon is the stronger model overall, scoring 56.5 to 36.5 on the Noometry Index.

Is Command A or Gemini 4 Argon better for coding?

Gemini 4 Argon scores higher on coding benchmarks: 62.0 versus 27.2 in the Noometry coding category.

How many benchmarks do Command A and Gemini 4 Argon share?

13 benchmarks have published results for both models. Command A has 24 scored results on Noometry and Gemini 4 Argon has 21.

Related comparisons

Go deeper