Model comparison

Kimi K2.5 Instant vs Magistral Small

Kimi K2.5 Instant is the stronger model overall, scoring 43.6 to 30.2 on the Noometry Index.

Last verified . 0 shared benchmarks.

Kimi K2.5 Instant Moonshot AI

43.6

Rank #89 Confirmed

Magistral Small Mistral AI

30.2

Rank #296 Confirmed

Summary

  • The widest gap is in reasoning, where Kimi K2.5 Instant leads 29.7 to 6.8.

Side by side

Kimi K2.5 Instant and Magistral Small specifications
Kimi K2.5 InstantMagistral Small
ProviderMoonshot AIMistral AI
Noometry Index43.630.2
Released—2025-06-10
WeightsOpenOpen
Context window—128K
Max output—40K
Input $ / M tokens—$0.50
Output $ / M tokens—$1.50
Results tracked1810

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Kimi K2.5 Instant leads

Kimi K2.5 Instant: 42.6 (#97), Magistral Small: 38.4 (#176)

Coding benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
LMArena WebDev1404—
SciCode—35.2%
LMArena Coding1484—

Reasoning Kimi K2.5 Instant leads

Kimi K2.5 Instant: 29.7 (#90), Magistral Small: 6.8 (#350)

Reasoning benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
ARC-AGI-2—0%
Kagi LLM Benchmark—6.3%
ARC-AGI-1—5%
CritPt—0.3%
Chess Puzzles—3%
LMArena Hard Prompts1443—
DTBench—61.3%
Epoch Capabilities Index—133.19

Math Kimi K2.5 Instant leads

Kimi K2.5 Instant: 39.4 (#105), Magistral Small: 26.2 (#261)

Math benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
OTIS Mock AIME 2024-2025—30%
LMArena Math1442—

Knowledge Kimi K2.5 Instant leads

Kimi K2.5 Instant: 40.2 (#123), Magistral Small: 30.9 (#223)

Knowledge benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
GPQA Diamond—56.1%
LMArena Expert1440—

Multimodal Not comparable

Kimi K2.5 Instant: 40.2 (#50), Magistral Small: —

Multimodal benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
LMArena Vision1254—

Multilingual Not comparable

Kimi K2.5 Instant: 52.0 (#94), Magistral Small: —

Multilingual benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
LMArena Non-English1406—
LMArena Chinese1449—
LMArena French1403—
LMArena German1413—
LMArena Korean1378—
LMArena Russian1404—
LMArena Spanish1447—

Instruction Following Not comparable

Kimi K2.5 Instant: 75.3 (#65), Magistral Small: —

Instruction Following benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
LMArena Instruction Following1430—

Long Context Not comparable

Kimi K2.5 Instant: 43.9 (#83), Magistral Small: —

Long Context benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
LMArena Longer Query1435—

Writing & Preference Not comparable

Kimi K2.5 Instant: 60.6 (#95), Magistral Small: —

Writing & Preference benchmarks
BenchmarkKimi K2.5 InstantMagistral Small
LMArena Text1420—
LMArena Creative Writing1381—
LMArena Multi-Turn1427—

Frequently asked questions

Is Kimi K2.5 Instant better than Magistral Small?

Kimi K2.5 Instant is the stronger model overall, scoring 43.6 to 30.2 on the Noometry Index.

Is Kimi K2.5 Instant or Magistral Small better for coding?

Kimi K2.5 Instant scores higher on coding benchmarks: 42.6 versus 38.4 in the Noometry coding category.

How many benchmarks do Kimi K2.5 Instant and Magistral Small share?

0 benchmarks have published results for both models. Kimi K2.5 Instant has 18 scored results on Noometry and Magistral Small has 10.

Related comparisons

Go deeper