Model comparison
Gemini Advanced 0514 vs Grok 4.3
Grok 4.3 is the stronger model overall, scoring 43.8 to 37.7 on the Noometry Index.
Last verified . 17 shared benchmarks.
Summary
- They share 17 benchmarks with published results for both. Gemini Advanced 0514 scores higher in 0 categories and Grok 4.3 in 8 categories; 8 gaps are clear of the uncertainty.
- The widest gap is in knowledge, where Grok 4.3 leads 52.5 to 33.3.
Side by side
| Gemini Advanced 0514 | Grok 4.3 | |
|---|---|---|
| Provider | xAI | |
| Noometry Index | 37.7 | 43.8 |
| Released | — | 2026-04-17 |
| Weights | Proprietary | Proprietary |
| Context window | — | 1M |
| Max output | — | 30K |
| Input $ / M tokens | — | $1.25 |
| Output $ / M tokens | — | $2.50 |
| Results tracked | 17 | 40 |
Sponsored placements are available on pages like this one. Advertise on Noometry
Category by category
Coding Grok 4.3 leads
Gemini Advanced 0514: 36.6 (#205), Grok 4.3: 41.6 (#121)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Coding | 1255 | 1415 |
| LMArena WebDev | — | 1357 |
| SciCode | — | 47.3% |
| WeirdML | — | 49.9% |
| ALE-Bench | — | 944.17 |
Agentic & Tool Use Not comparable
Gemini Advanced 0514: —, Grok 4.3: 27.7 (#99)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| GDP.pdf | — | 8% |
| LMArena Search | — | 1165 |
| Vending-Bench 2 | — | 35.26 |
Reasoning Grok 4.3 leads
Gemini Advanced 0514: 24.6 (#160), Grok 4.3: 35.9 (#68)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Hard Prompts | 1248 | 1396 |
| NYT Connections (extended) | — | 55.2% |
| CritPt | — | 8% |
| Chess Puzzles | — | 25% |
| DTBench | — | 90.7% |
| LMCA | — | 38.3% |
| Epoch Capabilities Index | — | 149.16 |
| ForecastBench | — | 60.3 |
Math Grok 4.3 leads
Gemini Advanced 0514: 35.5 (#181), Grok 4.3: 46.0 (#74)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Math | 1272 | 1388 |
| FrontierMath (Tiers 1-3) | — | 42.8% |
| FrontierMath Tier 4 | — | 14.6% |
| OTIS Mock AIME 2024-2025 | — | 93.3% |
| ProofBench | — | 11% |
Knowledge Grok 4.3 leads
Gemini Advanced 0514: 33.3 (#205), Grok 4.3: 52.5 (#62)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Expert | 1215 | 1385 |
| GPQA Diamond | — | 88.8% |
| SimpleQA Verified | — | 33.2% |
Multimodal Not comparable
Gemini Advanced 0514: —, Grok 4.3: 31.6 (#104)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Vision | — | 1229 |
| Blueprint-Bench 2 | — | 0% |
Multilingual Grok 4.3 leads
Gemini Advanced 0514: 42.6 (#192), Grok 4.3: 50.5 (#120)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Non-English | 1274 | 1385 |
| LMArena Chinese | 1274 | 1422 |
| LMArena French | 1307 | 1412 |
| LMArena German | 1275 | 1395 |
| LMArena Japanese | 1242 | 1379 |
| LMArena Korean | 1232 | 1356 |
| LMArena Russian | 1283 | 1399 |
| LMArena Spanish | 1242 | 1398 |
Instruction Following Grok 4.3 leads
Gemini Advanced 0514: 66.0 (#212), Grok 4.3: 72.1 (#140)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Instruction Following | 1253 | 1366 |
Long Context Grok 4.3 leads
Gemini Advanced 0514: 38.0 (#207), Grok 4.3: 42.5 (#123)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Longer Query | 1253 | 1393 |
Writing & Preference Grok 4.3 leads
Gemini Advanced 0514: 48.5 (#200), Grok 4.3: 58.5 (#118)
| Benchmark | Gemini Advanced 0514 | Grok 4.3 |
|---|---|---|
| LMArena Text | 1279 | 1397 |
| LMArena Creative Writing | 1284 | 1380 |
| LMArena Multi-Turn | 1269 | 1406 |
| EQ-Bench 4 | — | 1075 |
Frequently asked questions
Is Gemini Advanced 0514 better than Grok 4.3?
Grok 4.3 is the stronger model overall, scoring 43.8 to 37.7 on the Noometry Index.
Is Gemini Advanced 0514 or Grok 4.3 better for coding?
Grok 4.3 scores higher on coding benchmarks: 41.6 versus 36.6 in the Noometry coding category.
How many benchmarks do Gemini Advanced 0514 and Grok 4.3 share?
17 benchmarks have published results for both models. Gemini Advanced 0514 has 17 scored results on Noometry and Grok 4.3 has 40.