# Chatgpt 4o Latest 20250326 vs Qwen Plus

> Chatgpt 4o Latest 20250326 is the stronger model overall, scoring 43.8 to 37.1 on the Noometry Index.

- Canonical page: https://noometry.com/compare/chatgpt-4o-vs-qwen-plus
- Last updated: 2026-10-11
- Shared benchmarks: 14

## Summary

- They share 14 benchmarks with published results for both. Chatgpt 4o Latest 20250326 scores higher in 8 categories and Qwen Plus in 0 categories; 8 gaps are clear of the uncertainty.
- The widest gap is in math, where Chatgpt 4o Latest 20250326 leads 38.6 to 23.3.
- The biggest single-benchmark swing is Kagi LLM Benchmark: 75% for Chatgpt 4o Latest 20250326 and 63.3% for Qwen Plus.

## Snapshot

| | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| Provider | OpenAI | Alibaba (Qwen) |
| Noometry Index | 43.8 | 37.1 |
| Rank | 82 | 210 |
| Context | — | 1M |
| Input $/M | — | $0.40 |
| Output $/M | — | $1.20 |
| Weights | Proprietary | Proprietary |

## Coding

- Chatgpt 4o Latest 20250326: 41.6 (#122)
- Qwen Plus: 38.9 (#167)

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| LMArena Coding | 1413 | 1328 |

## Reasoning

- Chatgpt 4o Latest 20250326: 33.8 (#71)
- Qwen Plus: 28.4 (#107)

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| Kagi LLM Benchmark | 75% | 63.3% |
| LMArena Hard Prompts | 1424 | 1317 |
| DTBench | — | 81.1% |
| LMCA | — | 24% |

## Math

- Chatgpt 4o Latest 20250326: 38.6 (#134)
- Qwen Plus: 23.3 (#271)

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| LMArena Math | 1407 | 1326 |
| OTIS Mock AIME 2024-2025 | — | 17.8% |
| MATH Level 5 | — | 65.3% |
| FrontierMath (Feb 2025 set) | — | 1.7% |

## Knowledge

- Chatgpt 4o Latest 20250326: 39.2 (#137)
- Qwen Plus: 27.4 (#251)

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| LMArena Expert | 1401 | 1328 |
| GPQA Diamond | — | 48.1% |
| Confabulations | 16.6% | — |

## Multimodal

- Chatgpt 4o Latest 20250326: 39.6 (#58)
- Qwen Plus: —

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| LMArena Vision | 1243 | — |

## Multilingual

- Chatgpt 4o Latest 20250326: 52.9 (#76)
- Qwen Plus: 45.1 (#175)

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| LMArena Non-English | 1419 | 1310 |
| LMArena Chinese | 1457 | 1347 |
| LMArena Japanese | 1405 | 1251 |
| LMArena Russian | 1429 | 1323 |
| LMArena French | 1446 | — |
| LMArena German | 1423 | — |
| LMArena Korean | 1396 | — |
| LMArena Spanish | 1434 | — |

## Instruction Following

- Chatgpt 4o Latest 20250326: 74.0 (#107)
- Qwen Plus: 68.8 (#181)

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| LMArena Instruction Following | 1403 | 1303 |

## Long Context

- Chatgpt 4o Latest 20250326: 43.1 (#107)
- Qwen Plus: 40.3 (#158)

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| LMArena Longer Query | 1413 | 1324 |

## Writing & Preference

- Chatgpt 4o Latest 20250326: 62.6 (#72)
- Qwen Plus: 52.2 (#176)

| Benchmark | Chatgpt 4o Latest 20250326 | Qwen Plus |
|---|---|---|
| LMArena Text | 1429 | 1326 |
| LMArena Creative Writing | 1405 | 1293 |
| LMArena Multi-Turn | 1454 | 1336 |
| EQ-Bench Creative Writing | 1501 | — |

## FAQ

### Is Chatgpt 4o Latest 20250326 better than Qwen Plus?

Chatgpt 4o Latest 20250326 is the stronger model overall, scoring 43.8 to 37.1 on the Noometry Index.

### Is Chatgpt 4o Latest 20250326 or Qwen Plus better for coding?

Chatgpt 4o Latest 20250326 scores higher on coding benchmarks: 41.6 versus 38.9 in the Noometry coding category.

### How many benchmarks do Chatgpt 4o Latest 20250326 and Qwen Plus share?

14 benchmarks have published results for both models. Chatgpt 4o Latest 20250326 has 21 scored results on Noometry and Qwen Plus has 20.
