Model comparison

MiMo-V2-Omni vs Phi 3 Medium 4k Instruct

MiMo-V2-Omni is the stronger model overall, scoring 43.6 to 33.0 on the Noometry Index.

Last verified . 17 shared benchmarks.

MiMo-V2-Omni Xiaomi

43.6

Rank #88 Confirmed

Phi 3 Medium 4k Instruct Microsoft

33.0

Rank #250 Confirmed

Summary

  • They share 17 benchmarks with published results for both. MiMo-V2-Omni scores higher in 8 categories and Phi 3 Medium 4k Instruct in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where MiMo-V2-Omni leads 61.4 to 34.1.
  • Phi 3 Medium 4k Instruct has downloadable open weights; the other is API-only.

Side by side

MiMo-V2-Omni and Phi 3 Medium 4k Instruct specifications
MiMo-V2-OmniPhi 3 Medium 4k Instruct
ProviderXiaomiMicrosoft
Noometry Index43.633.0
Released2026-03-18—
WeightsProprietaryOpen
Context window262K—
Max output131K—
Input $ / M tokens$0.14—
Output $ / M tokens$0.28—
Results tracked1817

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding MiMo-V2-Omni leads

MiMo-V2-Omni: 43.3 (#89), Phi 3 Medium 4k Instruct: 32.9 (#268)

Coding benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Coding14661130

Reasoning MiMo-V2-Omni leads

MiMo-V2-Omni: 29.7 (#88), Phi 3 Medium 4k Instruct: 21.7 (#214)

Reasoning benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Hard Prompts14451127

Math MiMo-V2-Omni leads

MiMo-V2-Omni: 39.1 (#115), Phi 3 Medium 4k Instruct: 33.4 (#202)

Math benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Math14301173

Knowledge MiMo-V2-Omni leads

MiMo-V2-Omni: 40.5 (#118), Phi 3 Medium 4k Instruct: 30.2 (#229)

Knowledge benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Expert14491108

Multimodal Not comparable

MiMo-V2-Omni: 38.6 (#63), Phi 3 Medium 4k Instruct: —

Multimodal benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Vision1228—

Multilingual MiMo-V2-Omni leads

MiMo-V2-Omni: 51.8 (#102), Phi 3 Medium 4k Instruct: 30.6 (#263)

Multilingual benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Non-English14041094
LMArena Chinese14651108
LMArena French14471110
LMArena German13991101
LMArena Japanese13171042
LMArena Korean1355954
LMArena Russian14121145
LMArena Spanish14341095

Instruction Following MiMo-V2-Omni leads

MiMo-V2-Omni: 75.2 (#66), Phi 3 Medium 4k Instruct: 57.6 (#268)

Instruction Following benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Instruction Following14281113

Long Context MiMo-V2-Omni leads

MiMo-V2-Omni: 44.1 (#76), Phi 3 Medium 4k Instruct: 34.0 (#255)

Long Context benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Longer Query14421120

Writing & Preference MiMo-V2-Omni leads

MiMo-V2-Omni: 61.4 (#87), Phi 3 Medium 4k Instruct: 34.1 (#272)

Writing & Preference benchmarks
BenchmarkMiMo-V2-OmniPhi 3 Medium 4k Instruct
LMArena Text14231138
LMArena Creative Writing13921107
LMArena Multi-Turn14451088

Frequently asked questions

Is MiMo-V2-Omni better than Phi 3 Medium 4k Instruct?

MiMo-V2-Omni is the stronger model overall, scoring 43.6 to 33.0 on the Noometry Index.

Is MiMo-V2-Omni or Phi 3 Medium 4k Instruct better for coding?

MiMo-V2-Omni scores higher on coding benchmarks: 43.3 versus 32.9 in the Noometry coding category.

How many benchmarks do MiMo-V2-Omni and Phi 3 Medium 4k Instruct share?

17 benchmarks have published results for both models. MiMo-V2-Omni has 18 scored results on Noometry and Phi 3 Medium 4k Instruct has 17.

Related comparisons

Go deeper