Model comparison

Amazon Nova Pro vs Qwen1.5-110B

Qwen1.5-110B is the stronger model overall, scoring 34.2 to 31.0 on the Noometry Index.

Last verified . 17 shared benchmarks.

Amazon Nova Pro Amazon

31.0

Rank #281 Confirmed

Qwen1.5-110B Alibaba (Qwen)

34.2

Rank #234 Confirmed

Summary

  • They share 17 benchmarks with published results for both. Amazon Nova Pro scores higher in 5 categories and Qwen1.5-110B in 3 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in multilingual, where Amazon Nova Pro leads 39.7 to 33.6.
  • Qwen1.5-110B has downloadable open weights; the other is API-only.

Side by side

Amazon Nova Pro and Qwen1.5-110B specifications
Amazon Nova ProQwen1.5-110B
ProviderAmazonAlibaba (Qwen)
Noometry Index31.034.2
Released2024-12-032024-04-25
WeightsProprietaryOpen
Context window300K—
Max output10K—
Input $ / M tokens$0.80—
Output $ / M tokens$3.20—
Results tracked3820

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Amazon Nova Pro leads

Amazon Nova Pro: 35.1 (#229), Qwen1.5-110B: 33.0 (#264)

Coding benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Coding12701184
BigCodeBench Instruct—35%
LiveBench Coding38.1%—
BigCodeBench Complete—44.4%

Agentic & Tool Use Not comparable

Amazon Nova Pro: 16.7 (#147), Qwen1.5-110B: —

Agentic & Tool Use benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
Berkeley Function Calling Leaderboard25%—
TheAgentCompany1.7%—

Reasoning Qwen1.5-110B leads

Amazon Nova Pro: 20.0 (#243), Qwen1.5-110B: 22.7 (#189)

Reasoning benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Hard Prompts12461168
LiveBench Reasoning32.6%—
LiveBench Data Analysis48.3%—
Epoch Capabilities Index123.8—
ForecastBench—57.7
LiveBench43.5%—

Math Qwen1.5-110B leads

Amazon Nova Pro: 28.5 (#243), Qwen1.5-110B: 33.7 (#201)

Math benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Math12521185
Omni-MATH24.2%—
LiveBench Math38%—

Knowledge Qwen1.5-110B leads

Amazon Nova Pro: 27.4 (#250), Qwen1.5-110B: 31.2 (#219)

Knowledge benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Expert12111144
Humanity's Last Exam4.4%—
MMLU-Pro67.3%—
Confabulations30.1%—
Vectara Hallucination Rate5.1%—
GPQA (HELM)44.6%—
MMLU82%—

Multimodal Not comparable

Amazon Nova Pro: 25.0 (#126), Qwen1.5-110B: —

Multimodal benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Vision980—

Multilingual Amazon Nova Pro leads

Amazon Nova Pro: 39.7 (#223), Qwen1.5-110B: 33.6 (#250)

Multilingual benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Non-English12341142
LMArena Chinese12441206
LMArena French12711151
LMArena German12431123
LMArena Japanese12001074
LMArena Korean12031044
LMArena Russian12401118
LMArena Spanish11821142

Instruction Following Amazon Nova Pro leads

Amazon Nova Pro: 64.9 (#226), Qwen1.5-110B: 60.3 (#252)

Instruction Following benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Instruction Following12351158
LiveBench Instruction Following67.1%—
IFEval81.5%—

Long Context Amazon Nova Pro leads

Amazon Nova Pro: 38.1 (#205), Qwen1.5-110B: 35.1 (#242)

Long Context benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Longer Query12551157

Writing & Preference Amazon Nova Pro leads

Amazon Nova Pro: 43.9 (#226), Qwen1.5-110B: 38.0 (#255)

Writing & Preference benchmarks
BenchmarkAmazon Nova ProQwen1.5-110B
LMArena Text12591175
LMArena Creative Writing12121148
LMArena Multi-Turn12461160
Short-Story Creative Writing60.5%—
WildBench77.7%—
LiveBench Language37%—

Frequently asked questions

Is Amazon Nova Pro better than Qwen1.5-110B?

Qwen1.5-110B is the stronger model overall, scoring 34.2 to 31.0 on the Noometry Index.

Is Amazon Nova Pro or Qwen1.5-110B better for coding?

Amazon Nova Pro scores higher on coding benchmarks: 35.1 versus 33.0 in the Noometry coding category.

How many benchmarks do Amazon Nova Pro and Qwen1.5-110B share?

17 benchmarks have published results for both models. Amazon Nova Pro has 38 scored results on Noometry and Qwen1.5-110B has 20.

Related comparisons

Go deeper