Model comparison

Gemini 4 Argon vs MiMo-V2.5

Gemini 4 Argon is the stronger model overall, scoring 56.5 to 43.4 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini 4 Argon Google

56.5

Rank #24 Confirmed

MiMo-V2.5 Xiaomi

43.4

Rank #93 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Gemini 4 Argon scores higher in 9 categories and MiMo-V2.5 in 0 categories; 9 gaps are clear of the uncertainty.
  • The widest gap is in math, where Gemini 4 Argon leads 73.9 to 36.8.
  • The biggest single-benchmark swing is ProofBench: 99% for Gemini 4 Argon and 16% for MiMo-V2.5.
  • MiMo-V2.5 has downloadable open weights; the other is API-only.

Side by side

Gemini 4 Argon and MiMo-V2.5 specifications
Gemini 4 ArgonMiMo-V2.5
ProviderGoogleXiaomi
Noometry Index56.543.4
Released2026-09-302026-04-22
WeightsProprietaryOpen
Context window—1.05M
Max output—131K
Input $ / M tokens—$0.14
Output $ / M tokens—$0.28
Results tracked2123

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Gemini 4 Argon leads

Gemini 4 Argon: 62.0 (#9), MiMo-V2.5: 43.9 (#81)

Coding benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
LMArena WebDev16781438
SciCode61.8%43.1%
LMArena Coding15501469
FrontierSWE55%—
ALE-Bench—513.95

Agentic & Tool Use Not comparable

Gemini 4 Argon: 49.2 (#8), MiMo-V2.5: —

Agentic & Tool Use benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
APEX-Agents82.2%—
Vending-Bench 213,718—

Reasoning Gemini 4 Argon leads

Gemini 4 Argon: 44.2 (#47), MiMo-V2.5: 28.6 (#101)

Reasoning benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
CritPt27.1%3.7%
LMArena Hard Prompts15481450

Math Gemini 4 Argon leads

Gemini 4 Argon: 73.9 (#17), MiMo-V2.5: 36.8 (#163)

Math benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
ProofBench99%16%
LMArena Math15361436

Knowledge Gemini 4 Argon leads

Gemini 4 Argon: 43.9 (#89), MiMo-V2.5: 40.8 (#115)

Knowledge benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
LMArena Expert15531460

Multimodal Gemini 4 Argon leads

Gemini 4 Argon: 46.5 (#14), MiMo-V2.5: 39.8 (#54)

Multimodal benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
LMArena Vision—1247
Blueprint-Bench 254.4%—

Multilingual Gemini 4 Argon leads

Gemini 4 Argon: 60.3 (#1), MiMo-V2.5: 51.9 (#99)

Multilingual benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
LMArena Non-English15231404
LMArena Chinese16101468
LMArena Russian15371395
LMArena Spanish14971416
LMArena French—1447
LMArena German—1421
LMArena Japanese—1306
LMArena Korean—1363

Instruction Following Gemini 4 Argon leads

Gemini 4 Argon: 80.1 (#2), MiMo-V2.5: 75.5 (#60)

Instruction Following benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
LMArena Instruction Following15381434

Long Context Gemini 4 Argon leads

Gemini 4 Argon: 47.6 (#15), MiMo-V2.5: 44.2 (#73)

Long Context benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
LMArena Longer Query15491445

Writing & Preference Gemini 4 Argon leads

Gemini 4 Argon: 71.4 (#19), MiMo-V2.5: 61.6 (#86)

Writing & Preference benchmarks
BenchmarkGemini 4 ArgonMiMo-V2.5
LMArena Text15341428
LMArena Creative Writing15311393
LMArena Multi-Turn15571445

Frequently asked questions

Is Gemini 4 Argon better than MiMo-V2.5?

Gemini 4 Argon is the stronger model overall, scoring 56.5 to 43.4 on the Noometry Index.

Is Gemini 4 Argon or MiMo-V2.5 better for coding?

Gemini 4 Argon scores higher on coding benchmarks: 62.0 versus 43.9 in the Noometry coding category.

How many benchmarks do Gemini 4 Argon and MiMo-V2.5 share?

17 benchmarks have published results for both models. Gemini 4 Argon has 21 scored results on Noometry and MiMo-V2.5 has 23.

Related comparisons

Go deeper