Model comparison

Claude 3 Sonnet vs Yi-Lightning

Yi-Lightning is the stronger model overall, scoring 37.1 to 29.0 on the Noometry Index.

Last verified . 17 shared benchmarks.

Claude 3 Sonnet Anthropic

29.0

Rank #319 Confirmed

Yi-Lightning 01.AI

37.1

Rank #209 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Claude 3 Sonnet scores higher in 1 category and Yi-Lightning in 7 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Yi-Lightning leads 36.2 to 10.7.

Side by side

Claude 3 Sonnet and Yi-Lightning specifications
Claude 3 SonnetYi-Lightning
ProviderAnthropic01.AI
Noometry Index29.037.1
Released2024-02-292024-12-02
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked3018

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude 3 Sonnet leads

Claude 3 Sonnet: 29.6 (#302), Yi-Lightning: 27.4 (#320)

Coding benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Coding12231312
Aider Polyglot—12.9%
WeirdML10.2%—
BigCodeBench Instruct42.7%—
BigCodeBench Complete53.8%—
HumanEval+64%—
MBPP+69.3%—

Reasoning Yi-Lightning leads

Claude 3 Sonnet: 20.5 (#237), Yi-Lightning: 25.9 (#139)

Reasoning benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Hard Prompts11971302
DTBench53.6%—
Epoch Capabilities Index120.7—
WinoGrande75.1%—

Math Yi-Lightning leads

Claude 3 Sonnet: 10.7 (#310), Yi-Lightning: 36.2 (#172)

Math benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Math12131300
OTIS Mock AIME 2024-20252.5%—
MATH Level 518.2%—

Knowledge Yi-Lightning leads

Claude 3 Sonnet: 21.1 (#276), Yi-Lightning: 35.4 (#185)

Knowledge benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Expert11731286
GPQA Diamond40.6%—
MMLU75.9%—

Multimodal Not comparable

Claude 3 Sonnet: 25.2 (#125), Yi-Lightning: —

Multimodal benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Vision984—

Multilingual Yi-Lightning leads

Claude 3 Sonnet: 37.8 (#234), Yi-Lightning: 42.2 (#196)

Multilingual benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Non-English12051269
LMArena Chinese11891320
LMArena French12291305
LMArena German12041267
LMArena Japanese11311228
LMArena Korean11281192
LMArena Russian12271255
LMArena Spanish12041315

Instruction Following Yi-Lightning leads

Claude 3 Sonnet: 62.8 (#235), Yi-Lightning: 67.4 (#196)

Instruction Following benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Instruction Following11991278

Long Context Yi-Lightning leads

Claude 3 Sonnet: 36.7 (#228), Yi-Lightning: 39.4 (#181)

Long Context benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Longer Query12111297

Writing & Preference Yi-Lightning leads

Claude 3 Sonnet: 42.1 (#238), Yi-Lightning: 50.2 (#184)

Writing & Preference benchmarks
BenchmarkClaude 3 SonnetYi-Lightning
LMArena Text12181302
LMArena Creative Writing11861280
LMArena Multi-Turn12271311

Frequently asked questions

Is Claude 3 Sonnet better than Yi-Lightning?

Yi-Lightning is the stronger model overall, scoring 37.1 to 29.0 on the Noometry Index.

Is Claude 3 Sonnet or Yi-Lightning better for coding?

Claude 3 Sonnet scores higher on coding benchmarks: 29.6 versus 27.4 in the Noometry coding category.

How many benchmarks do Claude 3 Sonnet and Yi-Lightning share?

17 benchmarks have published results for both models. Claude 3 Sonnet has 30 scored results on Noometry and Yi-Lightning has 18.

Related comparisons

Go deeper