Model comparison

Chatgpt 4o Latest 20250326 vs Hunyuan T1 20250711

Chatgpt 4o Latest 20250326 is the stronger model overall, scoring 43.8 to 42.5 on the Noometry Index.

Last verified . 13 shared benchmarks.

Chatgpt 4o Latest 20250326 OpenAI

43.8

Rank #82 Confirmed

Hunyuan T1 20250711 Tencent

42.5

Rank #114 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Chatgpt 4o Latest 20250326 scores higher in 7 categories and Hunyuan T1 20250711 in 1 category; 4 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Chatgpt 4o Latest 20250326 leads 33.8 to 28.5.

Side by side

Chatgpt 4o Latest 20250326 and Hunyuan T1 20250711 specifications
Chatgpt 4o Latest 20250326Hunyuan T1 20250711
ProviderOpenAITencent
Noometry Index43.842.5
Released——
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2113

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Chatgpt 4o Latest 20250326: 41.6 (#122), Hunyuan T1 20250711: 40.9 (#129)

Coding benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Coding14131390

Reasoning Chatgpt 4o Latest 20250326 leads

Chatgpt 4o Latest 20250326: 33.8 (#71), Hunyuan T1 20250711: 28.5 (#103)

Reasoning benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Hard Prompts14241399
Kagi LLM Benchmark75%—

Math Too close to call

Chatgpt 4o Latest 20250326: 38.6 (#134), Hunyuan T1 20250711: 38.7 (#130)

Math benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Math14071414

Knowledge Too close to call

Chatgpt 4o Latest 20250326: 39.2 (#137), Hunyuan T1 20250711: 38.8 (#141)

Knowledge benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Expert14011395
Confabulations16.6%—

Multimodal Not comparable

Chatgpt 4o Latest 20250326: 39.6 (#58), Hunyuan T1 20250711: —

Multimodal benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Vision1243—

Multilingual Chatgpt 4o Latest 20250326 leads

Chatgpt 4o Latest 20250326: 52.9 (#76), Hunyuan T1 20250711: 51.2 (#112)

Multilingual benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Non-English14191395
LMArena Chinese14571425
LMArena Korean13961406
LMArena Russian14291385
LMArena French1446—
LMArena German1423—
LMArena Japanese1405—
LMArena Spanish1434—

Instruction Following Chatgpt 4o Latest 20250326 leads

Chatgpt 4o Latest 20250326: 74.0 (#107), Hunyuan T1 20250711: 72.6 (#138)

Instruction Following benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Instruction Following14031374

Long Context Too close to call

Chatgpt 4o Latest 20250326: 43.1 (#107), Hunyuan T1 20250711: 42.2 (#128)

Long Context benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Longer Query14131384

Writing & Preference Chatgpt 4o Latest 20250326 leads

Chatgpt 4o Latest 20250326: 62.6 (#72), Hunyuan T1 20250711: 59.5 (#109)

Writing & Preference benchmarks
BenchmarkChatgpt 4o Latest 20250326Hunyuan T1 20250711
LMArena Text14291401
LMArena Creative Writing14051392
LMArena Multi-Turn14541393
EQ-Bench Creative Writing1501—

Frequently asked questions

Is Chatgpt 4o Latest 20250326 better than Hunyuan T1 20250711?

Chatgpt 4o Latest 20250326 is the stronger model overall, scoring 43.8 to 42.5 on the Noometry Index.

Is Chatgpt 4o Latest 20250326 or Hunyuan T1 20250711 better for coding?

They score almost the same on coding (41.6 vs 40.9); test both on your own repository before choosing.

How many benchmarks do Chatgpt 4o Latest 20250326 and Hunyuan T1 20250711 share?

13 benchmarks have published results for both models. Chatgpt 4o Latest 20250326 has 21 scored results on Noometry and Hunyuan T1 20250711 has 13.

Related comparisons

Go deeper