Model comparison
Nova Premier 1.0 vs Qwen3 8B
Nova Premier 1.0 is the stronger model overall, scoring 38.3 to 33.7 on the Noometry Index. Qwen3 8B costs 16× less per token, which makes it the better buy when Nova Premier 1.0's lead doesn't matter for your workload.
Last verified . 0 shared benchmarks.
Summary
- The widest gap is in reasoning, where Nova Premier 1.0 leads 23.0 to 16.6.
- Qwen3 8B is cheaper at $0.18 / $0.70 per million input/output tokens, against $2.50 / $12.50 for Nova Premier 1.0.
- Nova Premier 1.0 accepts more context: 1M tokens versus 131K.
- Qwen3 8B has downloadable open weights; the other is API-only.
Side by side
| Nova Premier 1.0 | Qwen3 8B | |
|---|---|---|
| Provider | Amazon | Alibaba (Qwen) |
| Noometry Index | 38.3 | 33.7 |
| Released | 2025-04-30 | 2025-04 |
| Weights | Proprietary | Open |
| Context window | 1M | 131K |
| Max output | 10K | 8K |
| Input $ / M tokens | $2.50 | $0.18 |
| Output $ / M tokens | $12.50 | $0.70 |
| Results tracked | 6 | 11 |
Sponsored placements are available on pages like this one. Advertise on Noometry
Category by category
Coding Not comparable
Nova Premier 1.0: —, Qwen3 8B: 34.0 (#248)
| Benchmark | Nova Premier 1.0 | Qwen3 8B |
|---|---|---|
| SciCode | — | 22.6% |
Agentic & Tool Use Not comparable
Nova Premier 1.0: —, Qwen3 8B: 30.2 (#78)
| Benchmark | Nova Premier 1.0 | Qwen3 8B |
|---|---|---|
| Berkeley Function Calling Leaderboard | — | 42.6% |
Reasoning Nova Premier 1.0 leads
Nova Premier 1.0: 23.0 (#185), Qwen3 8B: 16.6 (#303)
| Benchmark | Nova Premier 1.0 | Qwen3 8B |
|---|---|---|
| Kagi LLM Benchmark | 44.8% | — |
| CritPt | — | 0% |
| Chess Puzzles | — | 5% |
| DTBench | — | 59.7% |
| LMCA | — | 8.8% |
| Epoch Capabilities Index | — | 136.17 |
Math Qwen3 8B leads
Nova Premier 1.0: 33.8 (#199), Qwen3 8B: 34.9 (#191)
| Benchmark | Nova Premier 1.0 | Qwen3 8B |
|---|---|---|
| OTIS Mock AIME 2024-2025 | — | 56.1% |
| Omni-MATH | 35% | — |
Knowledge Too close to call
Nova Premier 1.0: 35.8 (#180), Qwen3 8B: 36.1 (#173)
| Benchmark | Nova Premier 1.0 | Qwen3 8B |
|---|---|---|
| GPQA Diamond | — | 56.8% |
| MMLU-Pro | 72.6% | — |
| Vectara Hallucination Rate | — | 4.8% |
| GPQA (HELM) | 51.8% | — |
Instruction Following Not comparable
Nova Premier 1.0: 66.8 (#204), Qwen3 8B: —
| Benchmark | Nova Premier 1.0 | Qwen3 8B |
|---|---|---|
| IFEval | 80.3% | — |
Long Context Not comparable
Nova Premier 1.0: —, Qwen3 8B: 37.9 (#210)
| Benchmark | Nova Premier 1.0 | Qwen3 8B |
|---|---|---|
| Fiction.LiveBench | — | 62.1% |
Writing & Preference Not comparable
Nova Premier 1.0: 51.0 (#178), Qwen3 8B: —
| Benchmark | Nova Premier 1.0 | Qwen3 8B |
|---|---|---|
| WildBench | 78.8% | — |
Frequently asked questions
Is Nova Premier 1.0 better than Qwen3 8B?
Nova Premier 1.0 is the stronger model overall, scoring 38.3 to 33.7 on the Noometry Index. Qwen3 8B costs 16× less per token, which makes it the better buy when Nova Premier 1.0's lead doesn't matter for your workload.
Which is cheaper, Nova Premier 1.0 or Qwen3 8B?
Qwen3 8B is cheaper. It lists at $0.18 per million input tokens and $0.70 per million output tokens; Nova Premier 1.0 lists at $2.50 and $12.50.
Which has the bigger context window?
Nova Premier 1.0 does, with 1M tokens against 131K.
How many benchmarks do Nova Premier 1.0 and Qwen3 8B share?
0 benchmarks have published results for both models. Nova Premier 1.0 has 6 scored results on Noometry and Qwen3 8B has 11.