Model comparison

Gemma 2B vs Hunyuan Large Vision

Hunyuan Large Vision is the stronger model overall, scoring 37.6 to 29.6 on the Noometry Index.

Last verified . 11 shared benchmarks.

Gemma 2B Google

29.6

Rank #307 Confirmed

Hunyuan Large Vision Tencent

37.6

Rank #202 Confirmed

Summary

  • They share 11 benchmarks with published results for both. Gemma 2B scores higher in 0 categories and Hunyuan Large Vision in 7 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Hunyuan Large Vision leads 46.5 to 24.0.
  • Gemma 2B has downloadable open weights; the other is API-only.

Side by side

Gemma 2B and Hunyuan Large Vision specifications
Gemma 2BHunyuan Large Vision
ProviderGoogleTencent
Noometry Index29.637.6
Released2024-02-21—
WeightsOpenProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2313

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Hunyuan Large Vision leads

Gemma 2B: 29.4 (#305), Hunyuan Large Vision: 38.3 (#180)

Coding benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Coding10101308
HumanEval+20.7%—
MBPP+34.1%—

Reasoning Hunyuan Large Vision leads

Gemma 2B: 18.8 (#275), Hunyuan Large Vision: 24.8 (#158)

Reasoning benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Hard Prompts9891257
BIG-Bench Hard35.2%—
Epoch Capabilities Index94.2—
HellaSwag71.4%—
PIQA77.3%—
WinoGrande65.4%—

Math Hunyuan Large Vision leads

Gemma 2B: 30.0 (#239), Hunyuan Large Vision: 35.5 (#183)

Math benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Math10091268
GSM8K17.7%—

Knowledge Not comparable

Gemma 2B: —, Hunyuan Large Vision: 34.4 (#196)

Knowledge benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Expert—1252
ARC (AI2) Challenge42.1%—
BoolQ69.4%—
MMLU42.3%—
TriviaQA53.2%—

Multimodal Not comparable

Gemma 2B: —, Hunyuan Large Vision: 35.7 (#83)

Multimodal benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Vision—1180

Multilingual Hunyuan Large Vision leads

Gemma 2B: 23.0 (#294), Hunyuan Large Vision: 39.9 (#221)

Multilingual benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Non-English9581236
LMArena Chinese9861287
LMArena Russian9371243

Instruction Following Hunyuan Large Vision leads

Gemma 2B: 48.5 (#302), Hunyuan Large Vision: 65.8 (#215)

Instruction Following benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Instruction Following9701251

Long Context Hunyuan Large Vision leads

Gemma 2B: 29.9 (#291), Hunyuan Large Vision: 38.9 (#189)

Long Context benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Longer Query9811280

Writing & Preference Hunyuan Large Vision leads

Gemma 2B: 24.0 (#308), Hunyuan Large Vision: 46.5 (#218)

Writing & Preference benchmarks
BenchmarkGemma 2BHunyuan Large Vision
LMArena Text10021263
LMArena Creative Writing9871248
LMArena Multi-Turn9451254

Frequently asked questions

Is Gemma 2B better than Hunyuan Large Vision?

Hunyuan Large Vision is the stronger model overall, scoring 37.6 to 29.6 on the Noometry Index.

Is Gemma 2B or Hunyuan Large Vision better for coding?

Hunyuan Large Vision scores higher on coding benchmarks: 38.3 versus 29.4 in the Noometry coding category.

How many benchmarks do Gemma 2B and Hunyuan Large Vision share?

11 benchmarks have published results for both models. Gemma 2B has 23 scored results on Noometry and Hunyuan Large Vision has 13.

Related comparisons

Go deeper