Model comparison

Amazon Nova Experimental Chat 11 10 vs Mistral Large 4

Amazon Nova Experimental Chat 11 10 and Mistral Large 4 score almost the same on the Noometry Index (43.0 vs 43.1), so choose on price, context window or the category you care about most.

Last verified . 12 shared benchmarks.

Mistral Large 4 Mistral AI

43.1

Rank #99 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 11 10 scores higher in 2 categories and Mistral Large 4 in 6 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Amazon Nova Experimental Chat 11 10 leads 29.1 to 22.5.

Side by side

Amazon Nova Experimental Chat 11 10 and Mistral Large 4 specifications
Amazon Nova Experimental Chat 11 10Mistral Large 4
ProviderAmazonMistral AI
Noometry Index43.043.1
Released—2026-10-06
WeightsProprietaryProprietary
Context window—1.05M
Max output—262K
Input $ / M tokens—$0.68
Output $ / M tokens—$2.09
Results tracked1715

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Mistral Large 4 leads

Amazon Nova Experimental Chat 11 10: 42.3 (#107), Mistral Large 4: 48.6 (#57)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Mistral Large 4
LMArena Coding14331475
LMArena WebDev—1541

Reasoning Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 29.1 (#95), Mistral Large 4: 22.5 (#192)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Mistral Large 4
LMArena Hard Prompts14221444
NYT Connections (extended)—27.4%

Math Mistral Large 4 leads

Amazon Nova Experimental Chat 11 10: 39.1 (#114), Mistral Large 4: 40.4 (#91)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Mistral Large 4
LMArena Math14311488

Knowledge Amazon Nova Experimental Chat 11 10 leads

Amazon Nova Experimental Chat 11 10: 39.9 (#127), Mistral Large 4: 36.6 (#166)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Mistral Large 4
LMArena Expert14311447
SimpleQA Verified—20%

Multilingual Too close to call

Amazon Nova Experimental Chat 11 10: 51.9 (#98), Mistral Large 4: 52.6 (#82)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Mistral Large 4
LMArena Non-English14051415
LMArena Chinese14631491
LMArena Russian13941414
LMArena French1449—
LMArena German1395—
LMArena Japanese1383—
LMArena Korean1384—
LMArena Spanish1444—

Instruction Following Mistral Large 4 leads

Amazon Nova Experimental Chat 11 10: 73.2 (#122), Mistral Large 4: 75.0 (#76)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Mistral Large 4
LMArena Instruction Following13871424

Long Context Mistral Large 4 leads

Amazon Nova Experimental Chat 11 10: 42.5 (#121), Mistral Large 4: 43.6 (#89)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Mistral Large 4
LMArena Longer Query13951429

Writing & Preference Mistral Large 4 leads

Amazon Nova Experimental Chat 11 10: 58.8 (#114), Mistral Large 4: 60.4 (#97)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 11 10Mistral Large 4
LMArena Text14151427
LMArena Creative Writing13491361
LMArena Multi-Turn13801424

Frequently asked questions

Is Amazon Nova Experimental Chat 11 10 better than Mistral Large 4?

Amazon Nova Experimental Chat 11 10 and Mistral Large 4 score almost the same on the Noometry Index (43.0 vs 43.1), so choose on price, context window or the category you care about most.

Is Amazon Nova Experimental Chat 11 10 or Mistral Large 4 better for coding?

Mistral Large 4 scores higher on coding benchmarks: 48.6 versus 42.3 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 11 10 and Mistral Large 4 share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 11 10 has 17 scored results on Noometry and Mistral Large 4 has 15.

Related comparisons

Go deeper