Model comparison

Nova Premier 1.0 vs phi-3-medium 14B

Nova Premier 1.0 is the stronger model overall, scoring 38.3 to 29.7 on the Noometry Index.

Last verified . 0 shared benchmarks.

Nova Premier 1.0 Amazon

38.3

Rank #189 Confirmed

phi-3-medium 14B Microsoft

29.7

Rank #306 Reported

Summary

  • The widest gap is in knowledge, where Nova Premier 1.0 leads 35.8 to 9.1.
  • phi-3-medium 14B has downloadable open weights; the other is API-only.

Side by side

Nova Premier 1.0 and phi-3-medium 14B specifications
Nova Premier 1.0phi-3-medium 14B
ProviderAmazonMicrosoft
Noometry Index38.329.7
Released2025-04-302024-04-23
WeightsProprietaryOpen
Context window1M—
Max output10K—
Input $ / M tokens$2.50—
Output $ / M tokens$12.50—
Results tracked613

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

Nova Premier 1.0: —, phi-3-medium 14B: 36.8 (#201)

Coding benchmarks
BenchmarkNova Premier 1.0phi-3-medium 14B
BigCodeBench Instruct—37.6%
BigCodeBench Complete—48.7%

Reasoning Not comparable

Nova Premier 1.0: 23.0 (#185), phi-3-medium 14B: —

Reasoning benchmarks
BenchmarkNova Premier 1.0phi-3-medium 14B
Kagi LLM Benchmark44.8%—
Adversarial NLI—55.8%
BIG-Bench Hard—81.4%
Epoch Capabilities Index—121.23
HellaSwag—82.4%
WinoGrande—81.5%

Math Nova Premier 1.0 leads

Nova Premier 1.0: 33.8 (#199), phi-3-medium 14B: 27.3 (#250)

Math benchmarks
BenchmarkNova Premier 1.0phi-3-medium 14B
Omni-MATH35%—
MATH Level 5—17.6%

Knowledge Nova Premier 1.0 leads

Nova Premier 1.0: 35.8 (#180), phi-3-medium 14B: 9.1 (#306)

Knowledge benchmarks
BenchmarkNova Premier 1.0phi-3-medium 14B
GPQA Diamond—27.6%
MMLU-Pro72.6%—
GPQA (HELM)51.8%—
ARC (AI2) Challenge—91.6%
MMLU—78%
OpenBookQA—87.4%
TriviaQA—73.9%

Instruction Following Not comparable

Nova Premier 1.0: 66.8 (#204), phi-3-medium 14B: —

Instruction Following benchmarks
BenchmarkNova Premier 1.0phi-3-medium 14B
IFEval80.3%—

Writing & Preference Not comparable

Nova Premier 1.0: 51.0 (#178), phi-3-medium 14B: —

Writing & Preference benchmarks
BenchmarkNova Premier 1.0phi-3-medium 14B
WildBench78.8%—

Frequently asked questions

Is Nova Premier 1.0 better than phi-3-medium 14B?

Nova Premier 1.0 is the stronger model overall, scoring 38.3 to 29.7 on the Noometry Index.

How many benchmarks do Nova Premier 1.0 and phi-3-medium 14B share?

0 benchmarks have published results for both models. Nova Premier 1.0 has 6 scored results on Noometry and phi-3-medium 14B has 13.

Related comparisons

Go deeper