Model comparison

C4ai Aya Expanse 8b vs Qwen Max

C4ai Aya Expanse 8b and Qwen Max score almost the same on the Noometry Index (34.9 vs 34.7), so choose on price, context window or the category you care about most.

Last verified . 14 shared benchmarks.

C4ai Aya Expanse 8b Cohere

34.9

Rank #229 Confirmed

Qwen Max Alibaba (Qwen)

34.7

Rank #230 Confirmed

Summary

  • They share 14 benchmarks with published results for both. C4ai Aya Expanse 8b scores higher in 3 categories and Qwen Max in 5 categories; 8 gaps are clear of the uncertainty.
  • The widest gap is in math, where C4ai Aya Expanse 8b leads 33.3 to 22.3.
  • C4ai Aya Expanse 8b has downloadable open weights; the other is API-only.

Side by side

C4ai Aya Expanse 8b and Qwen Max specifications
C4ai Aya Expanse 8bQwen Max
ProviderCohereAlibaba (Qwen)
Noometry Index34.934.7
Released—2024-04-03
WeightsOpenProprietary
Context window—33K
Max output—8K
Input $ / M tokens—$1.60
Output $ / M tokens—$6.40
Results tracked1523

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding C4ai Aya Expanse 8b leads

C4ai Aya Expanse 8b: 33.8 (#252), Qwen Max: 30.7 (#292)

Coding benchmarks
BenchmarkC4ai Aya Expanse 8bQwen Max
LMArena Coding11601288
Aider Polyglot—21.8%

Reasoning Qwen Max leads

C4ai Aya Expanse 8b: 22.4 (#197), Qwen Max: 25.1 (#151)

Reasoning benchmarks
BenchmarkC4ai Aya Expanse 8bQwen Max
LMArena Hard Prompts11561269

Math C4ai Aya Expanse 8b leads

C4ai Aya Expanse 8b: 33.3 (#203), Qwen Max: 22.3 (#276)

Math benchmarks
BenchmarkC4ai Aya Expanse 8bQwen Max
LMArena Math11681275
OTIS Mock AIME 2024-2025—16.1%
MATH Level 5—67.2%
FrontierMath (Feb 2025 set)—1%

Knowledge C4ai Aya Expanse 8b leads

C4ai Aya Expanse 8b: 33.6 (#201), Qwen Max: 30.3 (#228)

Knowledge benchmarks
BenchmarkC4ai Aya Expanse 8bQwen Max
LMArena Expert11531248
GPQA Diamond—56.1%
Vectara Hallucination Rate9.5%—

Multilingual Qwen Max leads

C4ai Aya Expanse 8b: 36.1 (#242), Qwen Max: 41.8 (#202)

Multilingual benchmarks
BenchmarkC4ai Aya Expanse 8bQwen Max
LMArena Non-English11801263
LMArena Chinese11811254
LMArena German11881254
LMArena Japanese11201205
LMArena Russian11971274
LMArena French—1330
LMArena Korean—1142
LMArena Spanish—1290

Instruction Following Qwen Max leads

C4ai Aya Expanse 8b: 60.1 (#253), Qwen Max: 66.5 (#208)

Instruction Following benchmarks
BenchmarkC4ai Aya Expanse 8bQwen Max
LMArena Instruction Following11551262

Long Context Qwen Max leads

C4ai Aya Expanse 8b: 36.1 (#236), Qwen Max: 39.4 (#180)

Long Context benchmarks
BenchmarkC4ai Aya Expanse 8bQwen Max
LMArena Longer Query11911288
Fiction.LiveBench—66.7%

Writing & Preference Qwen Max leads

C4ai Aya Expanse 8b: 39.0 (#250), Qwen Max: 47.8 (#205)

Writing & Preference benchmarks
BenchmarkC4ai Aya Expanse 8bQwen Max
LMArena Text11851282
LMArena Creative Writing11681248
LMArena Multi-Turn11601277

Frequently asked questions

Is C4ai Aya Expanse 8b better than Qwen Max?

C4ai Aya Expanse 8b and Qwen Max score almost the same on the Noometry Index (34.9 vs 34.7), so choose on price, context window or the category you care about most.

Is C4ai Aya Expanse 8b or Qwen Max better for coding?

C4ai Aya Expanse 8b scores higher on coding benchmarks: 33.8 versus 30.7 in the Noometry coding category.

How many benchmarks do C4ai Aya Expanse 8b and Qwen Max share?

14 benchmarks have published results for both models. C4ai Aya Expanse 8b has 15 scored results on Noometry and Qwen Max has 23.

Related comparisons

Go deeper