Model comparison

Amazon Nova Experimental Chat 26 02 10 vs Mistral Large 4

Amazon Nova Experimental Chat 26 02 10 is the stronger model overall, scoring 44.5 to 43.1 on the Noometry Index.

Last verified . 12 shared benchmarks.

Mistral Large 4 Mistral AI

43.1

Rank #99 Confirmed

Summary

  • They share 12 benchmarks with published results for both. Amazon Nova Experimental Chat 26 02 10 scores higher in 6 categories and Mistral Large 4 in 2 categories; 6 gaps are clear of the uncertainty.
  • The widest gap is in reasoning, where Amazon Nova Experimental Chat 26 02 10 leads 30.1 to 22.5.

Side by side

Amazon Nova Experimental Chat 26 02 10 and Mistral Large 4 specifications
Amazon Nova Experimental Chat 26 02 10Mistral Large 4
ProviderAmazonMistral AI
Noometry Index44.543.1
Released—2026-10-06
WeightsProprietaryProprietary
Context window—1.05M
Max output—262K
Input $ / M tokens—$0.68
Output $ / M tokens—$2.09
Results tracked1215

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Mistral Large 4 leads

Amazon Nova Experimental Chat 26 02 10: 43.9 (#82), Mistral Large 4: 48.6 (#57)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Mistral Large 4
LMArena Coding14831475
LMArena WebDev—1541

Reasoning Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 30.1 (#86), Mistral Large 4: 22.5 (#192)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Mistral Large 4
LMArena Hard Prompts14581444
NYT Connections (extended)—27.4%

Math Mistral Large 4 leads

Amazon Nova Experimental Chat 26 02 10: 39.3 (#109), Mistral Large 4: 40.4 (#91)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Mistral Large 4
LMArena Math14381488

Knowledge Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 42.3 (#97), Mistral Large 4: 36.6 (#166)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Mistral Large 4
LMArena Expert15061447
SimpleQA Verified—20%

Multilingual Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 54.0 (#50), Mistral Large 4: 52.6 (#82)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Mistral Large 4
LMArena Non-English14341415
LMArena Chinese14631491
LMArena Russian14231414

Instruction Following Too close to call

Amazon Nova Experimental Chat 26 02 10: 75.2 (#69), Mistral Large 4: 75.0 (#76)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Mistral Large 4
LMArena Instruction Following14271424

Long Context Too close to call

Amazon Nova Experimental Chat 26 02 10: 44.0 (#77), Mistral Large 4: 43.6 (#89)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Mistral Large 4
LMArena Longer Query14411429

Writing & Preference Amazon Nova Experimental Chat 26 02 10 leads

Amazon Nova Experimental Chat 26 02 10: 61.8 (#84), Mistral Large 4: 60.4 (#97)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 26 02 10Mistral Large 4
LMArena Text14481427
LMArena Creative Writing13681361
LMArena Multi-Turn14421424

Frequently asked questions

Is Amazon Nova Experimental Chat 26 02 10 better than Mistral Large 4?

Amazon Nova Experimental Chat 26 02 10 is the stronger model overall, scoring 44.5 to 43.1 on the Noometry Index.

Is Amazon Nova Experimental Chat 26 02 10 or Mistral Large 4 better for coding?

Mistral Large 4 scores higher on coding benchmarks: 48.6 versus 43.9 in the Noometry coding category.

How many benchmarks do Amazon Nova Experimental Chat 26 02 10 and Mistral Large 4 share?

12 benchmarks have published results for both models. Amazon Nova Experimental Chat 26 02 10 has 12 scored results on Noometry and Mistral Large 4 has 15.

Related comparisons

Go deeper