Model comparison

Hunyuan Large Vision vs Mistral Medium

Hunyuan Large Vision is the stronger model overall, scoring 37.6 to 36.3 on the Noometry Index.

Last verified . 13 shared benchmarks.

Hunyuan Large Vision Tencent

37.6

Rank #202 Confirmed

Mistral Medium Mistral AI

36.3

Rank #218 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Hunyuan Large Vision scores higher in 5 categories and Mistral Medium in 4 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Mistral Medium leads 60.0 to 46.5.
  • Mistral Medium has downloadable open weights; the other is API-only.

Side by side

Hunyuan Large Vision and Mistral Medium specifications
Hunyuan Large VisionMistral Medium
ProviderTencentMistral AI
Noometry Index37.636.3
Released—2023-12-11
WeightsProprietaryOpen
Context window—262K
Max output—262K
Input $ / M tokens—$1.50
Output $ / M tokens—$7.50
Results tracked1336

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Hunyuan Large Vision leads

Hunyuan Large Vision: 38.3 (#180), Mistral Medium: 34.2 (#243)

Coding benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Coding13081434
FrontierCode—8%
SciCode—40.2%
WeirdML—43.7%
ALE-Bench—763.98

Agentic & Tool Use Not comparable

Hunyuan Large Vision: —, Mistral Medium: 28.3 (#90)

Agentic & Tool Use benchmarks
BenchmarkHunyuan Large VisionMistral Medium
Berkeley Function Calling Leaderboard—37.7%

Reasoning Too close to call

Hunyuan Large Vision: 24.8 (#158), Mistral Medium: 24.0 (#167)

Reasoning benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Hard Prompts12571426
Kagi LLM Benchmark—50%
CritPt—0%
DTBench—75.5%
LMCA—26.1%
Surface Evolver Bench—26.9%

Math Hunyuan Large Vision leads

Hunyuan Large Vision: 35.5 (#183), Mistral Medium: 28.1 (#245)

Math benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Math12681408
OTIS Mock AIME 2024-2025—32.2%
ProofBench—9%
MATH Level 5—81.6%
FrontierMath (Feb 2025 set)—0.3%

Knowledge Hunyuan Large Vision leads

Hunyuan Large Vision: 34.4 (#196), Mistral Medium: 25.0 (#265)

Knowledge benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Expert12521408
GPQA Diamond—59.5%
Humanity's Last Exam—4.5%
Vectara Hallucination Rate—22.7%

Multimodal Too close to call

Hunyuan Large Vision: 35.7 (#83), Mistral Medium: 35.3 (#88)

Multimodal benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Vision11801172

Multilingual Mistral Medium leads

Hunyuan Large Vision: 39.9 (#221), Mistral Medium: 52.1 (#91)

Multilingual benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Non-English12361408
LMArena Chinese12871447
LMArena Russian12431411
LMArena French—1459
LMArena German—1432
LMArena Japanese—1378
LMArena Korean—1380
LMArena Spanish—1433

Instruction Following Mistral Medium leads

Hunyuan Large Vision: 65.8 (#215), Mistral Medium: 73.7 (#116)

Instruction Following benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Instruction Following12511398

Long Context Mistral Medium leads

Hunyuan Large Vision: 38.9 (#189), Mistral Medium: 42.9 (#114)

Long Context benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Longer Query12801406

Writing & Preference Mistral Medium leads

Hunyuan Large Vision: 46.5 (#218), Mistral Medium: 60.0 (#103)

Writing & Preference benchmarks
BenchmarkHunyuan Large VisionMistral Medium
LMArena Text12631424
LMArena Creative Writing12481391
LMArena Multi-Turn12541418
Short-Story Creative Writing—77.3%

Frequently asked questions

Is Hunyuan Large Vision better than Mistral Medium?

Hunyuan Large Vision is the stronger model overall, scoring 37.6 to 36.3 on the Noometry Index.

Is Hunyuan Large Vision or Mistral Medium better for coding?

Hunyuan Large Vision scores higher on coding benchmarks: 38.3 versus 34.2 in the Noometry coding category.

How many benchmarks do Hunyuan Large Vision and Mistral Medium share?

13 benchmarks have published results for both models. Hunyuan Large Vision has 13 scored results on Noometry and Mistral Medium has 36.

Related comparisons

Go deeper