Model comparison

Amazon Nova Experimental Chat 26 01 10 vs Qwen3-Next 80B-A3B Instruct

Amazon Nova Experimental Chat 26 01 10 and Qwen3-Next 80B-A3B Instruct score almost the same on the Noometry Index (42.8 vs 43.0), so choose on price, context window or the category you care about most.

Last verified . 13 shared benchmarks.

Summary

  • They share 13 benchmarks with published results for both. Amazon Nova Experimental Chat 26 01 10 scores higher in 3 categories and Qwen3-Next 80B-A3B Instruct in 5 categories; 5 gaps are clear of the uncertainty.
  • The widest gap is in long context, where Amazon Nova Experimental Chat 26 01 10 leads 42.7 to 37.0.
  • Qwen3-Next 80B-A3B Instruct has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Experimental Chat 26 01 10 and Qwen3-Next 80B-A3B Instruct specifications
Amazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
ProviderAmazonAlibaba (Qwen)
Noometry Index42.843.0
Released—2025-09
WeightsProprietaryOpen
Context window—131K
Max output—33K
Input $ / M tokens—$0.50
Output $ / M tokens—$2
Results tracked1325

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Amazon Nova Experimental Chat 26 01 10: 42.7 (#96), Qwen3-Next 80B-A3B Instruct: 42.5 (#98)

Coding benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
LMArena Coding14471440

Reasoning Qwen3-Next 80B-A3B Instruct leads

Amazon Nova Experimental Chat 26 01 10: 28.9 (#98), Qwen3-Next 80B-A3B Instruct: 31.1 (#81)

Reasoning benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
LMArena Hard Prompts14151428
Kagi LLM Benchmark—66.7%

Math Too close to call

Amazon Nova Experimental Chat 26 01 10: 38.5 (#136), Qwen3-Next 80B-A3B Instruct: 38.8 (#126)

Math benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
LMArena Math14041440
Omni-MATH—46.7%

Knowledge Qwen3-Next 80B-A3B Instruct leads

Amazon Nova Experimental Chat 26 01 10: 40.3 (#120), Qwen3-Next 80B-A3B Instruct: 41.8 (#106)

Knowledge benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
LMArena Expert14441417
MMLU-Pro—78.6%
Vectara Hallucination Rate—9.3%
GPQA (HELM)—63%

Multilingual Qwen3-Next 80B-A3B Instruct leads

Amazon Nova Experimental Chat 26 01 10: 50.2 (#126), Qwen3-Next 80B-A3B Instruct: 52.1 (#93)

Multilingual benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
LMArena Non-English13811407
LMArena Chinese13721460
LMArena Russian13911404
LMArena Spanish13901435
LMArena French—1413
LMArena German—1417
LMArena Japanese—1395
LMArena Korean—1364

Instruction Following Amazon Nova Experimental Chat 26 01 10 leads

Amazon Nova Experimental Chat 26 01 10: 72.9 (#126), Qwen3-Next 80B-A3B Instruct: 70.8 (#159)

Instruction Following benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
LMArena Instruction Following13811389
IFEval—81%

Long Context Amazon Nova Experimental Chat 26 01 10 leads

Amazon Nova Experimental Chat 26 01 10: 42.7 (#119), Qwen3-Next 80B-A3B Instruct: 37.0 (#223)

Long Context benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
LMArena Longer Query14001403
Fiction.LiveBench—55.6%

Writing & Preference Too close to call

Amazon Nova Experimental Chat 26 01 10: 57.4 (#129), Qwen3-Next 80B-A3B Instruct: 58.0 (#121)

Writing & Preference benchmarks
BenchmarkAmazon Nova Experimental Chat 26 01 10Qwen3-Next 80B-A3B Instruct
LMArena Text13961417
LMArena Creative Writing13311334
LMArena Multi-Turn13801416
WildBench—80.7%

Frequently asked questions

Is Amazon Nova Experimental Chat 26 01 10 better than Qwen3-Next 80B-A3B Instruct?

Amazon Nova Experimental Chat 26 01 10 and Qwen3-Next 80B-A3B Instruct score almost the same on the Noometry Index (42.8 vs 43.0), so choose on price, context window or the category you care about most.

Is Amazon Nova Experimental Chat 26 01 10 or Qwen3-Next 80B-A3B Instruct better for coding?

They score almost the same on coding (42.7 vs 42.5); test both on your own repository before choosing.

How many benchmarks do Amazon Nova Experimental Chat 26 01 10 and Qwen3-Next 80B-A3B Instruct share?

13 benchmarks have published results for both models. Amazon Nova Experimental Chat 26 01 10 has 13 scored results on Noometry and Qwen3-Next 80B-A3B Instruct has 25.

Related comparisons

Go deeper