Model comparison

GLM-4.5-Air vs Nova Premier 1.0

GLM-4.5-Air and Nova Premier 1.0 score almost the same on the Noometry Index (38.9 vs 38.3), so choose on price, context window or the category you care about most.

Last verified . 6 shared benchmarks.

GLM-4.5-Air Z.ai (Zhipu)

38.9

Rank #177 Confirmed

Nova Premier 1.0 Amazon

38.3

Rank #189 Confirmed

Summary

  • They share 6 benchmarks with published results for both. GLM-4.5-Air scores higher in 4 categories and Nova Premier 1.0 in 1 category; 4 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where GLM-4.5-Air leads 55.9 to 51.0.
  • The biggest single-benchmark swing is GPQA (HELM): 59.4% for GLM-4.5-Air and 51.8% for Nova Premier 1.0.
  • GLM-4.5-Air is cheaper at $0.20 / $1.10 per million input/output tokens, against $2.50 / $12.50 for Nova Premier 1.0.
  • Nova Premier 1.0 accepts more context: 1M tokens versus 131K.
  • GLM-4.5-Air has downloadable open weights; the other is API-only.

Side by side

GLM-4.5-Air and Nova Premier 1.0 specifications
GLM-4.5-AirNova Premier 1.0
ProviderZ.ai (Zhipu)Amazon
Noometry Index38.938.3
Released2025-07-202025-04-30
WeightsOpenProprietary
Context window131K1M
Max output98K10K
Input $ / M tokens$0.20$2.50
Output $ / M tokens$1.10$12.50
Results tracked276

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

GLM-4.5-Air: 33.3 (#259), Nova Premier 1.0: —

Coding benchmarks
BenchmarkGLM-4.5-AirNova Premier 1.0
GSO2.9%—
LMArena Coding1397—

Reasoning GLM-4.5-Air leads

GLM-4.5-Air: 24.1 (#166), Nova Premier 1.0: 23.0 (#185)

Reasoning benchmarks
BenchmarkGLM-4.5-AirNova Premier 1.0
Kagi LLM Benchmark43%44.8%
LMArena Hard Prompts1379—
ForecastBench59.2—

Math GLM-4.5-Air leads

GLM-4.5-Air: 36.2 (#170), Nova Premier 1.0: 33.8 (#199)

Math benchmarks
BenchmarkGLM-4.5-AirNova Premier 1.0
Omni-MATH39.1%35%
LMArena Math1396—

Knowledge Too close to call

GLM-4.5-Air: 35.0 (#191), Nova Premier 1.0: 35.8 (#180)

Knowledge benchmarks
BenchmarkGLM-4.5-AirNova Premier 1.0
MMLU-Pro76.2%72.6%
GPQA (HELM)59.4%51.8%
Humanity's Last Exam8.1%—
Vectara Hallucination Rate9.3%—
LMArena Expert1370—

Multilingual Not comparable

GLM-4.5-Air: 49.1 (#135), Nova Premier 1.0: —

Multilingual benchmarks
BenchmarkGLM-4.5-AirNova Premier 1.0
LMArena Non-English1366—
LMArena Chinese1426—
LMArena French1399—
LMArena German1377—
LMArena Japanese1348—
LMArena Korean1308—
LMArena Russian1373—
LMArena Spanish1386—

Instruction Following GLM-4.5-Air leads

GLM-4.5-Air: 69.6 (#171), Nova Premier 1.0: 66.8 (#204)

Instruction Following benchmarks
BenchmarkGLM-4.5-AirNova Premier 1.0
IFEval81.2%80.3%
LMArena Instruction Following1354—

Long Context Not comparable

GLM-4.5-Air: 41.6 (#135), Nova Premier 1.0: —

Long Context benchmarks
BenchmarkGLM-4.5-AirNova Premier 1.0
LMArena Longer Query1366—

Writing & Preference GLM-4.5-Air leads

GLM-4.5-Air: 55.9 (#139), Nova Premier 1.0: 51.0 (#178)

Writing & Preference benchmarks
BenchmarkGLM-4.5-AirNova Premier 1.0
WildBench78.9%78.8%
LMArena Text1384—
LMArena Creative Writing1343—
LMArena Multi-Turn1371—

Frequently asked questions

Is GLM-4.5-Air better than Nova Premier 1.0?

GLM-4.5-Air and Nova Premier 1.0 score almost the same on the Noometry Index (38.9 vs 38.3), so choose on price, context window or the category you care about most.

Which is cheaper, GLM-4.5-Air or Nova Premier 1.0?

GLM-4.5-Air is cheaper. It lists at $0.20 per million input tokens and $1.10 per million output tokens; Nova Premier 1.0 lists at $2.50 and $12.50.

Which has the bigger context window?

Nova Premier 1.0 does, with 1M tokens against 131K.

How many benchmarks do GLM-4.5-Air and Nova Premier 1.0 share?

6 benchmarks have published results for both models. GLM-4.5-Air has 27 scored results on Noometry and Nova Premier 1.0 has 6.

Related comparisons

Go deeper