Model comparison

Claude 3 Sonnet vs Gemini 2.0 Pro

Gemini 2.0 Pro is the stronger model overall, scoring 39.1 to 29.0 on the Noometry Index.

Last verified . 3 shared benchmarks.

Claude 3 Sonnet Anthropic

29.0

Rank #319 Confirmed

Gemini 2.0 Pro Google

39.1

Rank #173 Confirmed

Summary

  • They share 3 benchmarks with published results for both. Claude 3 Sonnet scores higher in 1 category and Gemini 2.0 Pro in 6 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in math, where Gemini 2.0 Pro leads 39.7 to 10.7.
  • The biggest single-benchmark swing is MATH Level 5: 18.2% for Claude 3 Sonnet and 83.5% for Gemini 2.0 Pro.

Side by side

Claude 3 Sonnet and Gemini 2.0 Pro specifications
Claude 3 SonnetGemini 2.0 Pro
ProviderAnthropicGoogle
Noometry Index29.039.1
Released2024-02-292025-02-05
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked3014

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemini 2.0 Pro leads

Claude 3 Sonnet: 29.6 (#302), Gemini 2.0 Pro: 37.8 (#187)

Coding benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
Aider Polyglot—35.6%
WeirdML10.2%—
BigCodeBench Instruct42.7%—
LiveBench Coding—63.5%
LMArena Coding1223—
BigCodeBench Complete53.8%—
HumanEval+64%—
MBPP+69.3%—

Reasoning Gemini 2.0 Pro leads

Claude 3 Sonnet: 20.5 (#237), Gemini 2.0 Pro: 22.3 (#198)

Reasoning benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
Epoch Capabilities Index120.7135.06
EnigmaEval—0.7%
LiveBench Reasoning—60.1%
LMArena Hard Prompts1197—
DTBench53.6%—
LiveBench Data Analysis—68%
LiveBench—65.1%
WinoGrande75.1%—

Math Gemini 2.0 Pro leads

Claude 3 Sonnet: 10.7 (#310), Gemini 2.0 Pro: 39.7 (#100)

Math benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
MATH Level 518.2%83.5%
OTIS Mock AIME 2024-20252.5%—
LiveBench Math—71%
LMArena Math1213—

Knowledge Gemini 2.0 Pro leads

Claude 3 Sonnet: 21.1 (#276), Gemini 2.0 Pro: 36.5 (#167)

Knowledge benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
GPQA Diamond40.6%65.7%
Confabulations—18.4%
LMArena Expert1173—
MMLU75.9%—

Multimodal Not comparable

Claude 3 Sonnet: 25.2 (#125), Gemini 2.0 Pro: —

Multimodal benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
LMArena Vision984—

Multilingual Not comparable

Claude 3 Sonnet: 37.8 (#234), Gemini 2.0 Pro: —

Multilingual benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
LMArena Non-English1205—
LMArena Chinese1189—
LMArena French1229—
LMArena German1204—
LMArena Japanese1131—
LMArena Korean1128—
LMArena Russian1227—
LMArena Spanish1204—

Instruction Following Gemini 2.0 Pro leads

Claude 3 Sonnet: 62.8 (#235), Gemini 2.0 Pro: 75.5 (#59)

Instruction Following benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
LiveBench Instruction Following—83.4%
LMArena Instruction Following1199—

Long Context Claude 3 Sonnet leads

Claude 3 Sonnet: 36.7 (#228), Gemini 2.0 Pro: 29.2 (#292)

Long Context benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
Fiction.LiveBench—41.7%
LMArena Longer Query1211—

Writing & Preference Gemini 2.0 Pro leads

Claude 3 Sonnet: 42.1 (#238), Gemini 2.0 Pro: 52.7 (#165)

Writing & Preference benchmarks
BenchmarkClaude 3 SonnetGemini 2.0 Pro
LMArena Text1218—
LMArena Creative Writing1186—
LMArena Multi-Turn1227—
LiveBench Language—44.9%

Frequently asked questions

Is Claude 3 Sonnet better than Gemini 2.0 Pro?

Gemini 2.0 Pro is the stronger model overall, scoring 39.1 to 29.0 on the Noometry Index.

Is Claude 3 Sonnet or Gemini 2.0 Pro better for coding?

Gemini 2.0 Pro scores higher on coding benchmarks: 37.8 versus 29.6 in the Noometry coding category.

How many benchmarks do Claude 3 Sonnet and Gemini 2.0 Pro share?

3 benchmarks have published results for both models. Claude 3 Sonnet has 30 scored results on Noometry and Gemini 2.0 Pro has 14.

Related comparisons

Go deeper