Model comparison

Gemini 1.5 Flash 8B vs Qwen3-Coder 480B-A35B Instruct

Qwen3-Coder 480B-A35B Instruct is the stronger model overall, scoring 38.1 to 29.9 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini 1.5 Flash 8B Google

29.9

Rank #301 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Gemini 1.5 Flash 8B scores higher in 0 categories and Qwen3-Coder 480B-A35B Instruct in 8 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in math, where Qwen3-Coder 480B-A35B Instruct leads 37.6 to 14.2.
  • Qwen3-Coder 480B-A35B Instruct has downloadable open weights; the other is API-only.

Side by side

Gemini 1.5 Flash 8B and Qwen3-Coder 480B-A35B Instruct specifications
Gemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
ProviderGoogleAlibaba (Qwen)
Noometry Index29.938.1
Released2024-10-032025-04
WeightsProprietaryOpen
Context window—262K
Max output—66K
Input $ / M tokens—$1.50
Output $ / M tokens—$7.50
Results tracked2125

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Gemini 1.5 Flash 8B: 35.5 (#225), Qwen3-Coder 480B-A35B Instruct: 35.5 (#223)

Coding benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Coding12181412
SWE-bench Verified (bash only)—55.4%
LMArena WebDev—1275
GSO—4.9%
WeirdML—41.2%
ALE-Bench—461.45
AlgoTune—1.44

Agentic & Tool Use Not comparable

Gemini 1.5 Flash 8B: —, Qwen3-Coder 480B-A35B Instruct: 23.9 (#123)

Agentic & Tool Use benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
Terminal-Bench—27.2%

Reasoning Qwen3-Coder 480B-A35B Instruct leads

Gemini 1.5 Flash 8B: 20.0 (#244), Qwen3-Coder 480B-A35B Instruct: 25.5 (#149)

Reasoning benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Hard Prompts12091372
Kagi LLM Benchmark—49.5%
DTBench50%—

Math Qwen3-Coder 480B-A35B Instruct leads

Gemini 1.5 Flash 8B: 14.2 (#302), Qwen3-Coder 480B-A35B Instruct: 37.6 (#150)

Math benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Math12071365
OTIS Mock AIME 2024-20254.6%—

Knowledge Qwen3-Coder 480B-A35B Instruct leads

Gemini 1.5 Flash 8B: 16.0 (#289), Qwen3-Coder 480B-A35B Instruct: 37.0 (#162)

Knowledge benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Expert11851338
GPQA Diamond33%—

Multimodal Not comparable

Gemini 1.5 Flash 8B: 28.2 (#115), Qwen3-Coder 480B-A35B Instruct: —

Multimodal benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Vision1044—

Multilingual Qwen3-Coder 480B-A35B Instruct leads

Gemini 1.5 Flash 8B: 38.5 (#229), Qwen3-Coder 480B-A35B Instruct: 47.7 (#148)

Multilingual benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Non-English12151346
LMArena Chinese12311357
LMArena French12341398
LMArena German12061325
LMArena Japanese11501310
LMArena Korean11401305
LMArena Russian12361366
LMArena Spanish12121360

Instruction Following Qwen3-Coder 480B-A35B Instruct leads

Gemini 1.5 Flash 8B: 62.8 (#236), Qwen3-Coder 480B-A35B Instruct: 71.6 (#147)

Instruction Following benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Instruction Following11991355

Long Context Qwen3-Coder 480B-A35B Instruct leads

Gemini 1.5 Flash 8B: 37.0 (#225), Qwen3-Coder 480B-A35B Instruct: 42.0 (#131)

Long Context benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Longer Query12191378

Writing & Preference Qwen3-Coder 480B-A35B Instruct leads

Gemini 1.5 Flash 8B: 42.8 (#232), Qwen3-Coder 480B-A35B Instruct: 55.3 (#147)

Writing & Preference benchmarks
BenchmarkGemini 1.5 Flash 8BQwen3-Coder 480B-A35B Instruct
LMArena Text12261357
LMArena Creative Writing12181333
LMArena Multi-Turn11851365

Frequently asked questions

Is Gemini 1.5 Flash 8B better than Qwen3-Coder 480B-A35B Instruct?

Qwen3-Coder 480B-A35B Instruct is the stronger model overall, scoring 38.1 to 29.9 on the Noometry Index.

Is Gemini 1.5 Flash 8B or Qwen3-Coder 480B-A35B Instruct better for coding?

They score almost the same on coding (35.5 vs 35.5); test both on your own repository before choosing.

How many benchmarks do Gemini 1.5 Flash 8B and Qwen3-Coder 480B-A35B Instruct share?

17 benchmarks have published results for both models. Gemini 1.5 Flash 8B has 21 scored results on Noometry and Qwen3-Coder 480B-A35B Instruct has 25.

Related comparisons

Go deeper