Model comparison

Gemini 4 Argon vs Qwen3.5 Max Preview

Gemini 4 Argon is the stronger model overall, scoring 56.5 to 45.3 on the Noometry Index.

Last verified . 13 shared benchmarks.

Gemini 4 Argon Google

56.5

Rank #24 Confirmed

Qwen3.5 Max Preview Alibaba (Qwen)

45.3

Rank #71 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Gemini 4 Argon scores higher in 8 categories and Qwen3.5 Max Preview in 0 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where Gemini 4 Argon leads 73.9 to 40.1.

Side by side

Gemini 4 Argon and Qwen3.5 Max Preview specifications
Gemini 4 ArgonQwen3.5 Max Preview
ProviderGoogleAlibaba (Qwen)
Noometry Index56.545.3
Released2026-09-30—
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked2117

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemini 4 Argon leads

Gemini 4 Argon: 62.0 (#9), Qwen3.5 Max Preview: 44.0 (#77)

Coding benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
LMArena Coding15501487
LMArena WebDev1678—
FrontierSWE55%—
SciCode61.8%—

Agentic & Tool Use Not comparable

Gemini 4 Argon: 49.2 (#8), Qwen3.5 Max Preview: —

Agentic & Tool Use benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
APEX-Agents82.2%—
Vending-Bench 213,718—

Reasoning Gemini 4 Argon leads

Gemini 4 Argon: 44.2 (#47), Qwen3.5 Max Preview: 30.8 (#84)

Reasoning benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
LMArena Hard Prompts15481483
CritPt27.1%—

Math Gemini 4 Argon leads

Gemini 4 Argon: 73.9 (#17), Qwen3.5 Max Preview: 40.1 (#94)

Math benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
LMArena Math15361474
ProofBench99%—

Knowledge Gemini 4 Argon leads

Gemini 4 Argon: 43.9 (#89), Qwen3.5 Max Preview: 41.8 (#107)

Knowledge benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
LMArena Expert15531489

Multimodal Not comparable

Gemini 4 Argon: 46.5 (#14), Qwen3.5 Max Preview: —

Multimodal benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
Blueprint-Bench 254.4%—

Multilingual Gemini 4 Argon leads

Gemini 4 Argon: 60.3 (#1), Qwen3.5 Max Preview: 56.2 (#22)

Multilingual benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
LMArena Non-English15231465
LMArena Chinese16101534
LMArena Russian15371471
LMArena Spanish14971470
LMArena French—1484
LMArena German—1487
LMArena Japanese—1495
LMArena Korean—1438

Instruction Following Gemini 4 Argon leads

Gemini 4 Argon: 80.1 (#2), Qwen3.5 Max Preview: 77.0 (#31)

Instruction Following benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
LMArena Instruction Following15381467

Long Context Gemini 4 Argon leads

Gemini 4 Argon: 47.6 (#15), Qwen3.5 Max Preview: 45.2 (#45)

Long Context benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
LMArena Longer Query15491476

Writing & Preference Gemini 4 Argon leads

Gemini 4 Argon: 71.4 (#19), Qwen3.5 Max Preview: 66.0 (#41)

Writing & Preference benchmarks
BenchmarkGemini 4 ArgonQwen3.5 Max Preview
LMArena Text15341470
LMArena Creative Writing15311464
LMArena Multi-Turn15571478

Frequently asked questions

Is Gemini 4 Argon better than Qwen3.5 Max Preview?

Gemini 4 Argon is the stronger model overall, scoring 56.5 to 45.3 on the Noometry Index.

Is Gemini 4 Argon or Qwen3.5 Max Preview better for coding?

Gemini 4 Argon scores higher on coding benchmarks: 62.0 versus 44.0 in the Noometry coding category.

How many benchmarks do Gemini 4 Argon and Qwen3.5 Max Preview share?

13 benchmarks have published results for both models. Gemini 4 Argon has 21 scored results on Noometry and Qwen3.5 Max Preview has 17.

Related comparisons

Go deeper