Model comparison

MiniMax-M2.7 vs Nvidia Llama 3.3 Nemotron Super 49b v1.5

Nvidia Llama 3.3 Nemotron Super 49b v1.5 is the stronger model overall, scoring 40.3 to 37.7 on the Noometry Index.

Last verified . 12 shared benchmarks.

MiniMax-M2.7 MiniMax

37.7

Rank #196 Confirmed

Summary

  • They share 12 benchmarks with published results for both. MiniMax-M2.7 scores higher in 6 categories and Nvidia Llama 3.3 Nemotron Super 49b v1.5 in 2 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Nvidia Llama 3.3 Nemotron Super 49b v1.5 leads 38.2 to 25.9.
  • Nvidia Llama 3.3 Nemotron Super 49b v1.5 is cheaper at $0.40 / $0.40 per million input/output tokens, against $0.30 / $1.20 for MiniMax-M2.7.
  • MiniMax-M2.7 accepts more context: 205K tokens versus 131K.

Side by side

MiniMax-M2.7 and Nvidia Llama 3.3 Nemotron Super 49b v1.5 specifications
MiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
ProviderMiniMaxNVIDIA
Noometry Index37.740.3
Released2026-03-182025-07-25
WeightsOpenOpen
Context window205K131K
Max output131K131K
Input $ / M tokens$0.30$0.40
Output $ / M tokens$1.20$0.40
Results tracked3012

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding MiniMax-M2.7 leads

MiniMax-M2.7: 41.8 (#120), Nvidia Llama 3.3 Nemotron Super 49b v1.5: 39.8 (#154)

Coding benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
LMArena Coding14541355
LMArena WebDev1398—
SciCode47%—
WeirdML37%—
ALE-Bench599.25—

Agentic & Tool Use Not comparable

MiniMax-M2.7: 25.1 (#111), Nvidia Llama 3.3 Nemotron Super 49b v1.5: —

Agentic & Tool Use benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
Terminal-Bench45.1%—
ExploitBench13.3%—
GBAEval0%—

Reasoning Nvidia Llama 3.3 Nemotron Super 49b v1.5 leads

MiniMax-M2.7: 19.7 (#253), Nvidia Llama 3.3 Nemotron Super 49b v1.5: 26.8 (#128)

Reasoning benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
LMArena Hard Prompts14221336
NYT Connections (extended)24.7%—
CritPt0.6%—
Thematic Generalization39.3%—
Epoch Capabilities Index145.85—

Math Nvidia Llama 3.3 Nemotron Super 49b v1.5 leads

MiniMax-M2.7: 25.9 (#263), Nvidia Llama 3.3 Nemotron Super 49b v1.5: 38.2 (#141)

Math benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
LMArena Math14201392
ProofBench3%—

Knowledge MiniMax-M2.7 leads

MiniMax-M2.7: 37.7 (#152), Nvidia Llama 3.3 Nemotron Super 49b v1.5: 36.7 (#165)

Knowledge benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
LMArena Expert14441330
Vectara Hallucination Rate12.9%—

Multilingual MiniMax-M2.7 leads

MiniMax-M2.7: 50.3 (#123), Nvidia Llama 3.3 Nemotron Super 49b v1.5: 45.5 (#168)

Multilingual benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
LMArena Non-English13821316
LMArena Japanese12621300
LMArena Russian13831332
LMArena Chinese1441—
LMArena French1421—
LMArena German1398—
LMArena Korean1313—
LMArena Spanish1403—

Instruction Following MiniMax-M2.7 leads

MiniMax-M2.7: 74.1 (#103), Nvidia Llama 3.3 Nemotron Super 49b v1.5: 68.6 (#188)

Instruction Following benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
LMArena Instruction Following14051299

Long Context MiniMax-M2.7 leads

MiniMax-M2.7: 43.3 (#99), Nvidia Llama 3.3 Nemotron Super 49b v1.5: 40.0 (#164)

Long Context benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
LMArena Longer Query14191315

Writing & Preference MiniMax-M2.7 leads

MiniMax-M2.7: 58.9 (#112), Nvidia Llama 3.3 Nemotron Super 49b v1.5: 53.1 (#159)

Writing & Preference benchmarks
BenchmarkMiniMax-M2.7Nvidia Llama 3.3 Nemotron Super 49b v1.5
LMArena Text14051338
LMArena Creative Writing13541307
LMArena Multi-Turn14121334

Frequently asked questions

Is MiniMax-M2.7 better than Nvidia Llama 3.3 Nemotron Super 49b v1.5?

Nvidia Llama 3.3 Nemotron Super 49b v1.5 is the stronger model overall, scoring 40.3 to 37.7 on the Noometry Index.

Which is cheaper, MiniMax-M2.7 or Nvidia Llama 3.3 Nemotron Super 49b v1.5?

Nvidia Llama 3.3 Nemotron Super 49b v1.5 is cheaper. It lists at $0.40 per million input tokens and $0.40 per million output tokens; MiniMax-M2.7 lists at $0.30 and $1.20.

Is MiniMax-M2.7 or Nvidia Llama 3.3 Nemotron Super 49b v1.5 better for coding?

MiniMax-M2.7 scores higher on coding benchmarks: 41.8 versus 39.8 in the Noometry coding category.

Which has the bigger context window?

MiniMax-M2.7 does, with 205K tokens against 131K.

How many benchmarks do MiniMax-M2.7 and Nvidia Llama 3.3 Nemotron Super 49b v1.5 share?

12 benchmarks have published results for both models. MiniMax-M2.7 has 30 scored results on Noometry and Nvidia Llama 3.3 Nemotron Super 49b v1.5 has 12.

Related comparisons

Go deeper