# Gemini 1.5 Flash 8B vs Muse Spark 1.2

> Muse Spark 1.2 is the stronger model overall, scoring 50.3 to 29.9 on the Noometry Index.

- Canonical page: https://noometry.com/compare/gemini-1-5-flash-8b-vs-muse-spark-1-2
- Last updated: 2026-10-10
- Shared benchmarks: 16

## Summary

- They share 16 benchmarks with published results for both. Gemini 1.5 Flash 8B scores higher in 0 categories and Muse Spark 1.2 in 9 categories; 9 gaps are clear of the uncertainty.
- The widest gap is in knowledge, where Muse Spark 1.2 leads 54.1 to 16.0.
- The biggest single-benchmark swing is DTBench: 50% for Gemini 1.5 Flash 8B and 94.7% for Muse Spark 1.2.

## Snapshot

| | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| Provider | Google | Meta |
| Noometry Index | 29.9 | 50.3 |
| Rank | 301 | 48 |
| Context | — | 1.05M |
| Input $/M | — | $1.25 |
| Output $/M | — | $4.25 |
| Weights | Proprietary | Proprietary |

## Coding

- Gemini 1.5 Flash 8B: 35.5 (#225)
- Muse Spark 1.2: 49.2 (#51)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Coding | 1218 | 1495 |
| DeepSWE | — | 54.9% |
| LMArena WebDev | — | 1533 |
| FrontierSWE | — | 12% |
| SciCode | — | 56.4% |
| WeirdML | — | 60.3% |

## Agentic & Tool Use

- Gemini 1.5 Flash 8B: —
- Muse Spark 1.2: 29.4 (#87)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| APEX-Agents | — | 36.4% |
| GDP.pdf | — | 16% |

## Reasoning

- Gemini 1.5 Flash 8B: 20.0 (#244)
- Muse Spark 1.2: 51.3 (#34)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Hard Prompts | 1209 | 1486 |
| DTBench | 50% | 94.7% |
| SimpleBench | — | 74.5% |
| NYT Connections (extended) | — | 79.2% |
| CritPt | — | 17.7% |
| LMCA | — | 48.4% |
| Epoch Capabilities Index | — | 154.87 |

## Math

- Gemini 1.5 Flash 8B: 14.2 (#302)
- Muse Spark 1.2: 46.4 (#70)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Math | 1207 | 1471 |
| OTIS Mock AIME 2024-2025 | 4.6% | — |
| ProofBench | — | 43% |

## Knowledge

- Gemini 1.5 Flash 8B: 16.0 (#289)
- Muse Spark 1.2: 54.1 (#53)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Expert | 1185 | 1480 |
| GPQA Diamond | 33% | — |
| SimpleQA Verified | — | 60.3% |

## Multimodal

- Gemini 1.5 Flash 8B: 28.2 (#115)
- Muse Spark 1.2: 43.4 (#25)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Vision | 1044 | 1305 |

## Multilingual

- Gemini 1.5 Flash 8B: 38.5 (#229)
- Muse Spark 1.2: 57.1 (#11)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Non-English | 1215 | 1478 |
| LMArena Chinese | 1231 | 1511 |
| LMArena French | 1234 | 1513 |
| LMArena Russian | 1236 | 1487 |
| LMArena Spanish | 1212 | 1498 |
| LMArena German | 1206 | — |
| LMArena Japanese | 1150 | — |
| LMArena Korean | 1140 | — |

## Instruction Following

- Gemini 1.5 Flash 8B: 62.8 (#236)
- Muse Spark 1.2: 76.7 (#36)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Instruction Following | 1199 | 1461 |

## Long Context

- Gemini 1.5 Flash 8B: 37.0 (#225)
- Muse Spark 1.2: 45.2 (#48)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Longer Query | 1219 | 1475 |

## Writing & Preference

- Gemini 1.5 Flash 8B: 42.8 (#232)
- Muse Spark 1.2: 72.3 (#14)

| Benchmark | Gemini 1.5 Flash 8B | Muse Spark 1.2 |
|---|---|---|
| LMArena Text | 1226 | 1482 |
| LMArena Creative Writing | 1218 | 1449 |
| LMArena Multi-Turn | 1185 | 1494 |
| EQ-Bench Creative Writing | — | 1840 |

## FAQ

### Is Gemini 1.5 Flash 8B better than Muse Spark 1.2?

Muse Spark 1.2 is the stronger model overall, scoring 50.3 to 29.9 on the Noometry Index.

### Is Gemini 1.5 Flash 8B or Muse Spark 1.2 better for coding?

Muse Spark 1.2 scores higher on coding benchmarks: 49.2 versus 35.5 in the Noometry coding category.

### How many benchmarks do Gemini 1.5 Flash 8B and Muse Spark 1.2 share?

16 benchmarks have published results for both models. Gemini 1.5 Flash 8B has 21 scored results on Noometry and Muse Spark 1.2 has 31.
