Model comparison

Gemini Advanced 0514 vs Grok 4.6

Grok 4.6 is the stronger model overall, scoring 56.9 to 37.7 on the Noometry Index.

Last verified . 17 shared benchmarks.

Gemini Advanced 0514 Google

37.7

Rank #197 Confirmed

Grok 4.6 xAI

56.9

Rank #21 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Gemini Advanced 0514 scores higher in 0 categories and Grok 4.6 in 8 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Grok 4.6 leads 61.4 to 24.6.

Side by side

Gemini Advanced 0514 and Grok 4.6 specifications
Gemini Advanced 0514Grok 4.6
ProviderGooglexAI
Noometry Index37.756.9
Released—2026-08-12
WeightsProprietaryProprietary
Context window—500K
Max output—500K
Input $ / M tokens—$2
Output $ / M tokens—$6
Results tracked1749

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Grok 4.6 leads

Gemini Advanced 0514: 36.6 (#205), Grok 4.6: 58.5 (#16)

Coding benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Coding12551465
DeepSWE—67.5%
FrontierCode—48%
CursorBench—41.4%
LMArena WebDev—1617
FrontierSWE—25.3%
SciCode—56.5%
WeirdML—67.3%
ALE-Bench—1,508

Agentic & Tool Use Not comparable

Gemini Advanced 0514: —, Grok 4.6: 39.4 (#27)

Agentic & Tool Use benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
APEX-Agents—65.3%
GDP.pdf—17.2%
Vending-Bench 2—9,047

Reasoning Grok 4.6 leads

Gemini Advanced 0514: 24.6 (#160), Grok 4.6: 61.4 (#20)

Reasoning benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Hard Prompts12481447
ARC-AGI-2—67.1%
SimpleBench—75.9%
NYT Connections (extended)—80%
ARC-AGI-1—87.5%
CritPt—19.7%
Chess Puzzles—40%
EBR-Bench—30.5%
Mystery Game Puzzles—34%
DTBench—97.3%
LMCA—48.5%
Epoch Capabilities Index—156.44

Math Grok 4.6 leads

Gemini Advanced 0514: 35.5 (#181), Grok 4.6: 67.0 (#24)

Math benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Math12721423
FrontierMath (Tiers 1-3)—66%
FrontierMath Tier 4—31.7%
OTIS Mock AIME 2024-2025—99.2%
ProofBench—51%

Knowledge Grok 4.6 leads

Gemini Advanced 0514: 33.3 (#205), Grok 4.6: 63.3 (#20)

Knowledge benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Expert12151467
GPQA Diamond—94%
SimpleQA Verified—49.3%

Multimodal Not comparable

Gemini Advanced 0514: —, Grok 4.6: 43.6 (#23)

Multimodal benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Vision—1263
Blueprint-Bench 2—33.2%
Furniture Assembly—40%
LMArena Document—1452

Multilingual Grok 4.6 leads

Gemini Advanced 0514: 42.6 (#192), Grok 4.6: 53.0 (#74)

Multilingual benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Non-English12741420
LMArena Chinese12741480
LMArena French13071461
LMArena German12751431
LMArena Japanese12421376
LMArena Korean12321397
LMArena Russian12831422
LMArena Spanish12421404

Instruction Following Grok 4.6 leads

Gemini Advanced 0514: 66.0 (#212), Grok 4.6: 75.4 (#63)

Instruction Following benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Instruction Following12531431

Long Context Grok 4.6 leads

Gemini Advanced 0514: 38.0 (#207), Grok 4.6: 44.5 (#66)

Long Context benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Longer Query12531454

Writing & Preference Grok 4.6 leads

Gemini Advanced 0514: 48.5 (#200), Grok 4.6: 62.3 (#80)

Writing & Preference benchmarks
BenchmarkGemini Advanced 0514Grok 4.6
LMArena Text12791428
LMArena Creative Writing12841428
LMArena Multi-Turn12691425

Frequently asked questions

Is Gemini Advanced 0514 better than Grok 4.6?

Grok 4.6 is the stronger model overall, scoring 56.9 to 37.7 on the Noometry Index.

Is Gemini Advanced 0514 or Grok 4.6 better for coding?

Grok 4.6 scores higher on coding benchmarks: 58.5 versus 36.6 in the Noometry coding category.

How many benchmarks do Gemini Advanced 0514 and Grok 4.6 share?

17 benchmarks have published results for both models. Gemini Advanced 0514 has 17 scored results on Noometry and Grok 4.6 has 49.

Related comparisons

Go deeper