Model comparison

Gemini Advanced 0514 vs Grok 4.5

Grok 4.5 is the stronger model overall, scoring 55.0 to 37.7 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini Advanced 0514 Google

37.7

Rank #197 Confirmed

Grok 4.5 xAI

55.0

Rank #25 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Gemini Advanced 0514 scores higher in 0 categories and Grok 4.5 in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Grok 4.5 leads 56.1 to 24.6.

Side by side

Gemini Advanced 0514 and Grok 4.5 specifications
Gemini Advanced 0514Grok 4.5
ProviderGooglexAI
Noometry Index37.755.0
Released—2026-07-08
WeightsProprietaryProprietary
Context window—500K
Max output—500K
Input $ / M tokens—$2
Output $ / M tokens—$6
Results tracked1752

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Grok 4.5 leads

Gemini Advanced 0514: 36.6 (#205), Grok 4.5: 52.2 (#35)

Coding benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Coding12551474
DeepSWE—53.8%
FrontierCode—42.4%
LMArena WebDev—1553
SciCode—54.1%
WeirdML—46.4%
ALE-Bench—1,309

Agentic & Tool Use Not comparable

Gemini Advanced 0514: —, Grok 4.5: 44.4 (#17)

Agentic & Tool Use benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
APEX-Agents—56.2%
τ²-bench Banking—47.9%
PostTrainBench—23.4%
GBAEval—65.4%
GDP.pdf—14%
LMArena Search—1213
Vending-Bench 2—3,887

Reasoning Grok 4.5 leads

Gemini Advanced 0514: 24.6 (#160), Grok 4.5: 56.1 (#25)

Reasoning benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Hard Prompts12481462
ARC-AGI-2—52.6%
SimpleBench—70%
Kagi LLM Benchmark—83.5%
NYT Connections (extended)—79.9%
ARC-AGI-1—87.2%
CritPt—15.4%
Chess Puzzles—36%
DTBench—96.5%
LMCA—45.2%
Surface Evolver Bench—74.4%
Epoch Capabilities Index—153.92

Math Grok 4.5 leads

Gemini Advanced 0514: 35.5 (#181), Grok 4.5: 60.9 (#35)

Math benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Math12721459
FrontierMath (Tiers 1-3)—57.2%
FrontierMath Tier 4—24.4%
OTIS Mock AIME 2024-2025—97.8%
ProofBench—31%

Knowledge Grok 4.5 leads

Gemini Advanced 0514: 33.3 (#205), Grok 4.5: 62.3 (#24)

Knowledge benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Expert12151466
GPQA Diamond—93.4%
SimpleQA Verified—48.3%

Multimodal Not comparable

Gemini Advanced 0514: —, Grok 4.5: 37.6 (#72)

Multimodal benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Vision—1288
Blueprint-Bench 2—27.3%
Furniture Assembly—22.5%
LMArena Document—1452

Multilingual Grok 4.5 leads

Gemini Advanced 0514: 42.6 (#192), Grok 4.5: 54.4 (#42)

Multilingual benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Non-English12741440
LMArena Chinese12741496
LMArena French13071456
LMArena German12751446
LMArena Japanese12421428
LMArena Korean12321404
LMArena Russian12831448
LMArena Spanish12421450

Instruction Following Grok 4.5 leads

Gemini Advanced 0514: 66.0 (#212), Grok 4.5: 76.0 (#48)

Instruction Following benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Instruction Following12531446

Long Context Grok 4.5 leads

Gemini Advanced 0514: 38.0 (#207), Grok 4.5: 44.8 (#56)

Long Context benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Longer Query12531463

Writing & Preference Grok 4.5 leads

Gemini Advanced 0514: 48.5 (#200), Grok 4.5: 65.8 (#42)

Writing & Preference benchmarks
BenchmarkGemini Advanced 0514Grok 4.5
LMArena Text12791448
LMArena Creative Writing12841442
LMArena Multi-Turn12691456
EQ-Bench Creative Writing—1579

Frequently asked questions

Is Gemini Advanced 0514 better than Grok 4.5?

Grok 4.5 is the stronger model overall, scoring 55.0 to 37.7 on the Noometry Index.

Is Gemini Advanced 0514 or Grok 4.5 better for coding?

Grok 4.5 scores higher on coding benchmarks: 52.2 versus 36.6 in the Noometry coding category.

How many benchmarks do Gemini Advanced 0514 and Grok 4.5 share?

17 benchmarks have published results for both models. Gemini Advanced 0514 has 17 scored results on Noometry and Grok 4.5 has 52.

Related comparisons

Go deeper