Model comparison

Granite 3.0 2b Instruct vs Pixtral Large

Pixtral Large is the stronger model overall, scoring 32.2 to 30.8 on the Noometry Index.

Last verified . 0 shared benchmarks.

Granite 3.0 2b Instruct IBM

30.8

Rank #286 Confirmed

Pixtral Large Mistral AI

32.2

Rank #259 Reported

Summary

  • The widest gap is in writing & preference, where Pixtral Large leads 32.9 to 29.6.

Side by side

Granite 3.0 2b Instruct and Pixtral Large specifications
Granite 3.0 2b InstructPixtral Large
ProviderIBMMistral AI
Noometry Index30.832.2
Released—2024-11-01
WeightsOpenOpen
Context window—128K
Max output—128K
Input $ / M tokens—$2
Output $ / M tokens—$6
Results tracked133

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Not comparable

Granite 3.0 2b Instruct: 28.3 (#316), Pixtral Large: —

Coding benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
BigCodeBench Instruct20.5%—
LMArena Coding1090—

Reasoning Pixtral Large leads

Granite 3.0 2b Instruct: 20.5 (#235), Pixtral Large: 21.7 (#218)

Reasoning benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
EnigmaEval—0.8%
LMArena Hard Prompts1073—

Math Not comparable

Granite 3.0 2b Instruct: 32.2 (#217), Pixtral Large: —

Math benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
LMArena Math1117—

Knowledge Not comparable

Granite 3.0 2b Instruct: 29.0 (#241), Pixtral Large: —

Knowledge benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
LMArena Expert1064—

Multimodal Not comparable

Granite 3.0 2b Instruct: —, Pixtral Large: 30.6 (#111)

Multimodal benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
LMArena Vision—1089

Multilingual Not comparable

Granite 3.0 2b Instruct: 27.0 (#278), Pixtral Large: —

Multilingual benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
LMArena Non-English1033—
LMArena Chinese1070—
LMArena Russian1045—

Instruction Following Not comparable

Granite 3.0 2b Instruct: 53.9 (#284), Pixtral Large: —

Instruction Following benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
LMArena Instruction Following1056—

Long Context Not comparable

Granite 3.0 2b Instruct: 32.5 (#268), Pixtral Large: —

Long Context benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
LMArena Longer Query1070—

Writing & Preference Pixtral Large leads

Granite 3.0 2b Instruct: 29.6 (#292), Pixtral Large: 32.9 (#278)

Writing & Preference benchmarks
BenchmarkGranite 3.0 2b InstructPixtral Large
LMArena Text1080—
LMArena Creative Writing1046—
EQ-Bench Creative Writing—988
LMArena Multi-Turn1053—

Frequently asked questions

Is Granite 3.0 2b Instruct better than Pixtral Large?

Pixtral Large is the stronger model overall, scoring 32.2 to 30.8 on the Noometry Index.

How many benchmarks do Granite 3.0 2b Instruct and Pixtral Large share?

0 benchmarks have published results for both models. Granite 3.0 2b Instruct has 13 scored results on Noometry and Pixtral Large has 3.

Related comparisons

Go deeper