Model comparison

Deepseek Coder v2 vs Qwen Plus

Qwen Plus is the stronger model overall, scoring 37.1 to 35.9 on the Noometry Index.

Last verified . 13 shared benchmarks.

Deepseek Coder v2 DeepSeek

35.9

Rank #220 Confirmed

Qwen Plus Alibaba (Qwen)

37.1

Rank #210 Confirmed

Summary

  • They share 13 benchmarks with published results for both. Deepseek Coder v2 scores higher in 2 categories and Qwen Plus in 6 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in writing & preference, where Qwen Plus leads 52.2 to 38.2.
  • Deepseek Coder v2 has downloadable open weights; the other is API-only.

Side by side

Deepseek Coder v2 and Qwen Plus specifications
Deepseek Coder v2Qwen Plus
ProviderDeepSeekAlibaba (Qwen)
Noometry Index35.937.1
Released2024-06-172024-01-25
WeightsOpenProprietary
Context window—1M
Max output—33K
Input $ / M tokens—$0.40
Output $ / M tokens—$1.20
Results tracked2420

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Deepseek Coder v2: 38.1 (#183), Qwen Plus: 38.9 (#167)

Coding benchmarks
BenchmarkDeepseek Coder v2Qwen Plus
LMArena Coding12511328
BigCodeBench Instruct48.2%—
BigCodeBench Complete59.7%—
HumanEval+82.3%—
MBPP+75.1%—

Reasoning Qwen Plus leads

Deepseek Coder v2: 23.6 (#176), Qwen Plus: 28.4 (#107)

Reasoning benchmarks
BenchmarkDeepseek Coder v2Qwen Plus
LMArena Hard Prompts12071317
Kagi LLM Benchmark—63.3%
DTBench—81.1%
LMCA—24%
WinoGrande83.7%—

Math Deepseek Coder v2 leads

Deepseek Coder v2: 34.9 (#190), Qwen Plus: 23.3 (#271)

Math benchmarks
BenchmarkDeepseek Coder v2Qwen Plus
LMArena Math12411326
OTIS Mock AIME 2024-2025—17.8%
MATH Level 5—65.3%
FrontierMath (Feb 2025 set)—1.7%
GSM8K94.5%—

Knowledge Deepseek Coder v2 leads

Deepseek Coder v2: 32.3 (#212), Qwen Plus: 27.4 (#251)

Knowledge benchmarks
BenchmarkDeepseek Coder v2Qwen Plus
LMArena Expert11811328
GPQA Diamond—48.1%
ARC (AI2) Challenge64.3%—

Multilingual Qwen Plus leads

Deepseek Coder v2: 36.3 (#240), Qwen Plus: 45.1 (#175)

Multilingual benchmarks
BenchmarkDeepseek Coder v2Qwen Plus
LMArena Non-English11821310
LMArena Chinese12011347
LMArena Japanese11261251
LMArena Russian11881323
LMArena French1185—
LMArena German1164—
LMArena Korean1104—
LMArena Spanish1153—

Instruction Following Qwen Plus leads

Deepseek Coder v2: 61.7 (#242), Qwen Plus: 68.8 (#181)

Instruction Following benchmarks
BenchmarkDeepseek Coder v2Qwen Plus
LMArena Instruction Following11801303

Long Context Qwen Plus leads

Deepseek Coder v2: 37.0 (#224), Qwen Plus: 40.3 (#158)

Long Context benchmarks
BenchmarkDeepseek Coder v2Qwen Plus
LMArena Longer Query12191324

Writing & Preference Qwen Plus leads

Deepseek Coder v2: 38.2 (#253), Qwen Plus: 52.2 (#176)

Writing & Preference benchmarks
BenchmarkDeepseek Coder v2Qwen Plus
LMArena Text11911326
LMArena Creative Writing11201293
LMArena Multi-Turn11771336

Frequently asked questions

Is Deepseek Coder v2 better than Qwen Plus?

Qwen Plus is the stronger model overall, scoring 37.1 to 35.9 on the Noometry Index.

Is Deepseek Coder v2 or Qwen Plus better for coding?

They score almost the same on coding (38.1 vs 38.9); test both on your own repository before choosing.

How many benchmarks do Deepseek Coder v2 and Qwen Plus share?

13 benchmarks have published results for both models. Deepseek Coder v2 has 24 scored results on Noometry and Qwen Plus has 20.

Related comparisons

Go deeper