Model comparison

Claude 3 Sonnet vs Gemini 1.5 Pro (May 2024)

Gemini 1.5 Pro (May 2024) is the stronger model overall, scoring 32.1 to 29.0 on the Noometry Index.

Last verified . 29 shared benchmarks.

Claude 3 Sonnet Anthropic

29.0

Rank #319 Confirmed

Gemini 1.5 Pro (May 2024) Google

32.1

Rank #261 Confirmed

Summary

  • They share 29 benchmarks with published results for both. Claude 3 Sonnet scores higher in 1 category and Gemini 1.5 Pro (May 2024) in 8 categories; 9 gaps are clear of the uncertainty.
  • The widest gap is in math, where Gemini 1.5 Pro (May 2024) leads 25.8 to 10.7.
  • The biggest single-benchmark swing is MATH Level 5: 18.2% for Claude 3 Sonnet and 70.4% for Gemini 1.5 Pro (May 2024).

Side by side

Claude 3 Sonnet and Gemini 1.5 Pro (May 2024) specifications
Claude 3 SonnetGemini 1.5 Pro (May 2024)
ProviderAnthropicGoogle
Noometry Index29.032.1
Released2024-02-292024-02-15
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked3045

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemini 1.5 Pro (May 2024) leads

Claude 3 Sonnet: 29.6 (#302), Gemini 1.5 Pro (May 2024): 34.2 (#241)

Coding benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
WeirdML10.2%22.2%
BigCodeBench Instruct42.7%43.8%
LMArena Coding12231294
BigCodeBench Complete53.8%57.5%
HumanEval+64%79.3%
MBPP+69.3%74.6%
CadEval—34%

Agentic & Tool Use Not comparable

Claude 3 Sonnet: —, Gemini 1.5 Pro (May 2024): 17.9 (#145)

Agentic & Tool Use benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
TheAgentCompany—3.4%
Cybench—7.5%
BALROG—21%

Reasoning Claude 3 Sonnet leads

Claude 3 Sonnet: 20.5 (#237), Gemini 1.5 Pro (May 2024): 12.3 (#338)

Reasoning benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
LMArena Hard Prompts11971296
DTBench53.6%59%
Epoch Capabilities Index120.7131.73
ARC-AGI-2—0.8%
SimpleBench—27.1%
BIG-Bench Hard—89.2%
ForecastBench—58.4
WinoGrande75.1%—

Math Gemini 1.5 Pro (May 2024) leads

Claude 3 Sonnet: 10.7 (#310), Gemini 1.5 Pro (May 2024): 25.8 (#266)

Math benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
OTIS Mock AIME 2024-20252.5%23.1%
LMArena Math12131315
MATH Level 518.2%70.4%
Omni-MATH—36.4%

Knowledge Gemini 1.5 Pro (May 2024) leads

Claude 3 Sonnet: 21.1 (#276), Gemini 1.5 Pro (May 2024): 29.4 (#239)

Knowledge benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
GPQA Diamond40.6%57.2%
LMArena Expert11731279
MMLU75.9%86.9%
Humanity's Last Exam—4.6%
MMLU-Pro—73.7%
Confabulations—13.5%
GPQA (HELM)—53.4%

Multimodal Gemini 1.5 Pro (May 2024) leads

Claude 3 Sonnet: 25.2 (#125), Gemini 1.5 Pro (May 2024): 36.8 (#77)

Multimodal benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
LMArena Vision9841161
Video-MME—75%

Multilingual Gemini 1.5 Pro (May 2024) leads

Claude 3 Sonnet: 37.8 (#234), Gemini 1.5 Pro (May 2024): 45.3 (#174)

Multilingual benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
LMArena Non-English12051312
LMArena Chinese11891331
LMArena French12291302
LMArena German12041286
LMArena Japanese11311292
LMArena Korean11281298
LMArena Russian12271320
LMArena Spanish12041311

Instruction Following Gemini 1.5 Pro (May 2024) leads

Claude 3 Sonnet: 62.8 (#235), Gemini 1.5 Pro (May 2024): 68.6 (#185)

Instruction Following benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
LMArena Instruction Following11991297
IFEval—83.7%

Long Context Gemini 1.5 Pro (May 2024) leads

Claude 3 Sonnet: 36.7 (#228), Gemini 1.5 Pro (May 2024): 39.8 (#169)

Long Context benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
LMArena Longer Query12111308

Writing & Preference Gemini 1.5 Pro (May 2024) leads

Claude 3 Sonnet: 42.1 (#238), Gemini 1.5 Pro (May 2024): 52.4 (#172)

Writing & Preference benchmarks
BenchmarkClaude 3 SonnetGemini 1.5 Pro (May 2024)
LMArena Text12181319
LMArena Creative Writing11861333
LMArena Multi-Turn12271296
WildBench—81.3%

Frequently asked questions

Is Claude 3 Sonnet better than Gemini 1.5 Pro (May 2024)?

Gemini 1.5 Pro (May 2024) is the stronger model overall, scoring 32.1 to 29.0 on the Noometry Index.

Is Claude 3 Sonnet or Gemini 1.5 Pro (May 2024) better for coding?

Gemini 1.5 Pro (May 2024) scores higher on coding benchmarks: 34.2 versus 29.6 in the Noometry coding category.

How many benchmarks do Claude 3 Sonnet and Gemini 1.5 Pro (May 2024) share?

29 benchmarks have published results for both models. Claude 3 Sonnet has 30 scored results on Noometry and Gemini 1.5 Pro (May 2024) has 45.

Related comparisons

Go deeper