Model comparison

Kimi K2 Thinking Turbo vs Sonar

Kimi K2 Thinking Turbo is the stronger model overall, scoring 45.8 to 38.5 on the Noometry Index.

Last verified . 0 shared benchmarks.

Kimi K2 Thinking Turbo Moonshot AI

45.8

Rank #70 Confirmed

Sonar Perplexity

38.5

Rank #187 Confirmed

Summary

  • The widest gap is in math, where Kimi K2 Thinking Turbo leads 47.4 to 33.7.
  • Kimi K2 Thinking Turbo has downloadable open weights; the other is API-only.

Side by side

Kimi K2 Thinking Turbo and Sonar specifications
Kimi K2 Thinking TurboSonar
ProviderMoonshot AIPerplexity
Noometry Index45.838.5
Released2025-11-062024-01-01
WeightsOpenProprietary
Context window—128K
Max output—4K
Input $ / M tokens—$1
Output $ / M tokens—$1
Results tracked217

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Kimi K2 Thinking Turbo leads

Kimi K2 Thinking Turbo: 38.4 (#178), Sonar: 35.7 (#221)

Coding benchmarks
BenchmarkKimi K2 Thinking TurboSonar
LMArena WebDev1322—
LiveBench Coding—35.1%
LMArena Coding1454—

Reasoning Kimi K2 Thinking Turbo leads

Kimi K2 Thinking Turbo: 32.5 (#75), Sonar: 21.1 (#227)

Reasoning benchmarks
BenchmarkKimi K2 Thinking TurboSonar
Chess Puzzles20%—
LiveBench Reasoning—46.3%
LMArena Hard Prompts1428—
LiveBench Data Analysis—37.9%
LiveBench—46.9%

Math Kimi K2 Thinking Turbo leads

Kimi K2 Thinking Turbo: 47.4 (#68), Sonar: 33.7 (#200)

Math benchmarks
BenchmarkKimi K2 Thinking TurboSonar
OTIS Mock AIME 2024-202583.1%—
LiveBench Math—41.6%
LMArena Math1429—

Knowledge Not comparable

Kimi K2 Thinking Turbo: 50.9 (#69), Sonar: —

Knowledge benchmarks
BenchmarkKimi K2 Thinking TurboSonar
GPQA Diamond84.2%—
LMArena Expert1439—

Multilingual Not comparable

Kimi K2 Thinking Turbo: 51.4 (#109), Sonar: —

Multilingual benchmarks
BenchmarkKimi K2 Thinking TurboSonar
LMArena Non-English1398—
LMArena Chinese1456—
LMArena French1425—
LMArena German1390—
LMArena Japanese1357—
LMArena Korean1330—
LMArena Russian1391—
LMArena Spanish1406—

Instruction Following Kimi K2 Thinking Turbo leads

Kimi K2 Thinking Turbo: 74.0 (#109), Sonar: 71.4 (#150)

Instruction Following benchmarks
BenchmarkKimi K2 Thinking TurboSonar
LiveBench Instruction Following—76.2%
LMArena Instruction Following1403—

Long Context Not comparable

Kimi K2 Thinking Turbo: 43.2 (#102), Sonar: —

Long Context benchmarks
BenchmarkKimi K2 Thinking TurboSonar
LMArena Longer Query1415—

Writing & Preference Kimi K2 Thinking Turbo leads

Kimi K2 Thinking Turbo: 60.0 (#104), Sonar: 52.6 (#167)

Writing & Preference benchmarks
BenchmarkKimi K2 Thinking TurboSonar
LMArena Text1415—
LMArena Creative Writing1374—
LMArena Multi-Turn1414—
LiveBench Language—44.1%

Frequently asked questions

Is Kimi K2 Thinking Turbo better than Sonar?

Kimi K2 Thinking Turbo is the stronger model overall, scoring 45.8 to 38.5 on the Noometry Index.

Is Kimi K2 Thinking Turbo or Sonar better for coding?

Kimi K2 Thinking Turbo scores higher on coding benchmarks: 38.4 versus 35.7 in the Noometry coding category.

How many benchmarks do Kimi K2 Thinking Turbo and Sonar share?

0 benchmarks have published results for both models. Kimi K2 Thinking Turbo has 21 scored results on Noometry and Sonar has 7.

Related comparisons

Go deeper