Model comparison

Granite 3.0 8b Instruct vs Qwen2.5-VL 72B Instruct

Granite 3.0 8b Instruct is the stronger model overall, scoring 31.6 to 29.9 on the Noometry Index.

Last verified . 0 shared benchmarks.

Granite 3.0 8b Instruct IBM

31.6

Rank #270 Confirmed

Side by side

Granite 3.0 8b Instruct and Qwen2.5-VL 72B Instruct specifications
Granite 3.0 8b InstructQwen2.5-VL 72B Instruct
ProviderIBMAlibaba (Qwen)
Noometry Index31.629.9
Released—2024-09
WeightsOpenOpen
Context window—131K
Max output—8K
Input $ / M tokens—$2.80
Output $ / M tokens—$8.40
Results tracked146

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

Granite 3.0 8b Instruct: 29.7 (#301), Qwen2.5-VL 72B Instruct: —

Coding benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
BigCodeBench Instruct29.3%—
LMArena Coding1112—
BigCodeBench Complete35.4%—

Agentic & Tool Use Not comparable

Granite 3.0 8b Instruct: —, Qwen2.5-VL 72B Instruct: 18.6 (#144)

Agentic & Tool Use benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
OSWorld—5%

Reasoning Too close to call

Granite 3.0 8b Instruct: 20.9 (#230), Qwen2.5-VL 72B Instruct: 20.7 (#233)

Reasoning benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
Kagi LLM Benchmark—36%
LMArena Hard Prompts1092—

Math Not comparable

Granite 3.0 8b Instruct: 32.8 (#210), Qwen2.5-VL 72B Instruct: —

Math benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
LMArena Math1143—

Knowledge Not comparable

Granite 3.0 8b Instruct: 29.6 (#236), Qwen2.5-VL 72B Instruct: —

Knowledge benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
LMArena Expert1087—

Multimodal Not comparable

Granite 3.0 8b Instruct: —, Qwen2.5-VL 72B Instruct: 33.5 (#97)

Multimodal benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
LMArena Vision—1107
Video-MME—73.5%
GeoBench—62%
SpatialViz-Bench—33.3%

Multilingual Not comparable

Granite 3.0 8b Instruct: 27.2 (#276), Qwen2.5-VL 72B Instruct: —

Multilingual benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
LMArena Non-English1037—
LMArena Chinese1063—
LMArena Russian1060—

Instruction Following Not comparable

Granite 3.0 8b Instruct: 56.0 (#276), Qwen2.5-VL 72B Instruct: —

Instruction Following benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
LMArena Instruction Following1088—

Long Context Not comparable

Granite 3.0 8b Instruct: 34.0 (#252), Qwen2.5-VL 72B Instruct: —

Long Context benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
LMArena Longer Query1122—

Writing & Preference Not comparable

Granite 3.0 8b Instruct: 31.1 (#285), Qwen2.5-VL 72B Instruct: —

Writing & Preference benchmarks
BenchmarkGranite 3.0 8b InstructQwen2.5-VL 72B Instruct
LMArena Text1096—
LMArena Creative Writing1071—
LMArena Multi-Turn1063—

Frequently asked questions

Is Granite 3.0 8b Instruct better than Qwen2.5-VL 72B Instruct?

Granite 3.0 8b Instruct is the stronger model overall, scoring 31.6 to 29.9 on the Noometry Index.

How many benchmarks do Granite 3.0 8b Instruct and Qwen2.5-VL 72B Instruct share?

0 benchmarks have published results for both models. Granite 3.0 8b Instruct has 14 scored results on Noometry and Qwen2.5-VL 72B Instruct has 6.

Related comparisons

Go deeper