Model comparison
Nvidia Llama 3.3 Nemotron Super 49b v1.5 vs QwQ-32B
Nvidia Llama 3.3 Nemotron Super 49b v1.5 and QwQ-32B score almost the same on the Noometry Index (40.3 vs 39.8), so choose on price, context window or the category you care about most.
Last verified . 12 shared benchmarks.
Summary
- They share 12 benchmarks with published results for both. Nvidia Llama 3.3 Nemotron Super 49b v1.5 scores higher in 5 categories and QwQ-32B in 3 categories; 5 gaps are clear of the uncertainty.
- The widest gap is in long context, where QwQ-32B leads 49.0 to 40.0.
Side by side
| Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B | |
|---|---|---|
| Provider | NVIDIA | Alibaba (Qwen) |
| Noometry Index | 40.3 | 39.8 |
| Released | 2025-07-25 | 2024-11-28 |
| Weights | Open | Open |
| Context window | 131K | — |
| Max output | 131K | — |
| Input $ / M tokens | $0.40 | — |
| Output $ / M tokens | $0.40 | — |
| Results tracked | 12 | 36 |
Sponsored placements are available on pages like this one. Advertise on Noometry
Category by category
Coding Nvidia Llama 3.3 Nemotron Super 49b v1.5 leads
Nvidia Llama 3.3 Nemotron Super 49b v1.5: 39.8 (#154), QwQ-32B: 35.4 (#226)
| Benchmark | Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B |
|---|---|---|
| LMArena Coding | 1355 | 1333 |
| Aider Polyglot | — | 20.9% |
| BigCodeBench Instruct | — | 44.6% |
| LiveBench Coding | — | 72.2% |
| BigCodeBench Complete | — | 54.4% |
Reasoning Nvidia Llama 3.3 Nemotron Super 49b v1.5 leads
Nvidia Llama 3.3 Nemotron Super 49b v1.5: 26.8 (#128), QwQ-32B: 23.7 (#174)
| Benchmark | Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B |
|---|---|---|
| LMArena Hard Prompts | 1336 | 1325 |
| Chess Puzzles | — | 5% |
| LiveBench Reasoning | — | 83.5% |
| LiveBench Data Analysis | — | 65% |
| Epoch Capabilities Index | — | 137.6 |
| ForecastBench | — | 58.3 |
| LiveBench | — | 72% |
Math Too close to call
Nvidia Llama 3.3 Nemotron Super 49b v1.5: 38.2 (#141), QwQ-32B: 38.0 (#143)
| Benchmark | Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B |
|---|---|---|
| LMArena Math | 1392 | 1359 |
| OTIS Mock AIME 2024-2025 | — | 59.2% |
| LiveBench Math | — | 77.8% |
Knowledge Too close to call
Nvidia Llama 3.3 Nemotron Super 49b v1.5: 36.7 (#165), QwQ-32B: 37.2 (#158)
| Benchmark | Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B |
|---|---|---|
| LMArena Expert | 1330 | 1324 |
| GPQA Diamond | — | 65.3% |
| Confabulations | — | 15.6% |
Multilingual Too close to call
Nvidia Llama 3.3 Nemotron Super 49b v1.5: 45.5 (#168), QwQ-32B: 44.8 (#176)
| Benchmark | Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B |
|---|---|---|
| LMArena Non-English | 1316 | 1305 |
| LMArena Japanese | 1300 | 1262 |
| LMArena Russian | 1332 | 1297 |
| LMArena Chinese | — | 1378 |
| LMArena French | — | 1336 |
| LMArena German | — | 1313 |
| LMArena Korean | — | 1279 |
| LMArena Spanish | — | 1354 |
Instruction Following QwQ-32B leads
Nvidia Llama 3.3 Nemotron Super 49b v1.5: 68.6 (#188), QwQ-32B: 72.6 (#137)
| Benchmark | Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B |
|---|---|---|
| LMArena Instruction Following | 1299 | 1297 |
| LiveBench Instruction Following | — | 81.8% |
Long Context QwQ-32B leads
Nvidia Llama 3.3 Nemotron Super 49b v1.5: 40.0 (#164), QwQ-32B: 49.0 (#11)
| Benchmark | Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B |
|---|---|---|
| LMArena Longer Query | 1315 | 1308 |
| Fiction.LiveBench | — | 83.3% |
Writing & Preference Nvidia Llama 3.3 Nemotron Super 49b v1.5 leads
Nvidia Llama 3.3 Nemotron Super 49b v1.5: 53.1 (#159), QwQ-32B: 50.6 (#180)
| Benchmark | Nvidia Llama 3.3 Nemotron Super 49b v1.5 | QwQ-32B |
|---|---|---|
| LMArena Text | 1338 | 1329 |
| LMArena Creative Writing | 1307 | 1288 |
| LMArena Multi-Turn | 1334 | 1314 |
| Short-Story Creative Writing | — | 80.2% |
| EQ-Bench Creative Writing | — | 1257 |
| LiveBench Language | — | 51.4% |
Frequently asked questions
Is Nvidia Llama 3.3 Nemotron Super 49b v1.5 better than QwQ-32B?
Nvidia Llama 3.3 Nemotron Super 49b v1.5 and QwQ-32B score almost the same on the Noometry Index (40.3 vs 39.8), so choose on price, context window or the category you care about most.
Is Nvidia Llama 3.3 Nemotron Super 49b v1.5 or QwQ-32B better for coding?
Nvidia Llama 3.3 Nemotron Super 49b v1.5 scores higher on coding benchmarks: 39.8 versus 35.4 in the Noometry coding category.
How many benchmarks do Nvidia Llama 3.3 Nemotron Super 49b v1.5 and QwQ-32B share?
12 benchmarks have published results for both models. Nvidia Llama 3.3 Nemotron Super 49b v1.5 has 12 scored results on Noometry and QwQ-32B has 36.