Model comparison

Gemma 1.1 7b IT vs Phi 3 Mini 4k Instruct June 2024

Gemma 1.1 7b IT and Phi 3 Mini 4k Instruct June 2024 score almost the same on the Noometry Index (31.3 vs 31.3), so choose on price, context window or the category you care about most.

Last verified . 15 shared benchmarks.

Gemma 1.1 7b IT Google

31.3

Rank #277 Confirmed

Summary

  • They share 15 benchmarks with published results for both. Gemma 1.1 7b IT scores higher in 3 categories and Phi 3 Mini 4k Instruct June 2024 in 5 categories; one gap is clear of the uncertainty.

Side by side

Gemma 1.1 7b IT and Phi 3 Mini 4k Instruct June 2024 specifications
Gemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
ProviderGoogleMicrosoft
Noometry Index31.331.3
Released——
WeightsOpenOpen
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked1915

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Too close to call

Gemma 1.1 7b IT: 31.5 (#284), Phi 3 Mini 4k Instruct June 2024: 31.8 (#279)

Coding benchmarks
BenchmarkGemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
LMArena Coding10841093
HumanEval+35.4%—
MBPP+45%—

Reasoning Too close to call

Gemma 1.1 7b IT: 20.5 (#238), Phi 3 Mini 4k Instruct June 2024: 20.8 (#231)

Reasoning benchmarks
BenchmarkGemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
LMArena Hard Prompts10711087

Math Too close to call

Gemma 1.1 7b IT: 32.0 (#220), Phi 3 Mini 4k Instruct June 2024: 33.0 (#208)

Math benchmarks
BenchmarkGemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
LMArena Math11071152

Knowledge Too close to call

Gemma 1.1 7b IT: 28.3 (#247), Phi 3 Mini 4k Instruct June 2024: 28.6 (#244)

Knowledge benchmarks
BenchmarkGemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
LMArena Expert10391051

Multilingual Gemma 1.1 7b IT leads

Gemma 1.1 7b IT: 28.1 (#273), Phi 3 Mini 4k Instruct June 2024: 25.9 (#282)

Multilingual benchmarks
BenchmarkGemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
LMArena Non-English10521013
LMArena Chinese10611033
LMArena German10541031
LMArena Japanese971954
LMArena Korean988880
LMArena Russian10461019
LMArena French1065—
LMArena Spanish1049—

Instruction Following Too close to call

Gemma 1.1 7b IT: 54.0 (#283), Phi 3 Mini 4k Instruct June 2024: 54.1 (#282)

Instruction Following benchmarks
BenchmarkGemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
LMArena Instruction Following10571058

Long Context Too close to call

Gemma 1.1 7b IT: 32.1 (#272), Phi 3 Mini 4k Instruct June 2024: 31.7 (#277)

Long Context benchmarks
BenchmarkGemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
LMArena Longer Query10561042

Writing & Preference Too close to call

Gemma 1.1 7b IT: 30.4 (#288), Phi 3 Mini 4k Instruct June 2024: 29.6 (#294)

Writing & Preference benchmarks
BenchmarkGemma 1.1 7b ITPhi 3 Mini 4k Instruct June 2024
LMArena Text10941080
LMArena Creative Writing10601045
LMArena Multi-Turn10401049

Frequently asked questions

Is Gemma 1.1 7b IT better than Phi 3 Mini 4k Instruct June 2024?

Gemma 1.1 7b IT and Phi 3 Mini 4k Instruct June 2024 score almost the same on the Noometry Index (31.3 vs 31.3), so choose on price, context window or the category you care about most.

Is Gemma 1.1 7b IT or Phi 3 Mini 4k Instruct June 2024 better for coding?

They score almost the same on coding (31.5 vs 31.8); test both on your own repository before choosing.

How many benchmarks do Gemma 1.1 7b IT and Phi 3 Mini 4k Instruct June 2024 share?

15 benchmarks have published results for both models. Gemma 1.1 7b IT has 19 scored results on Noometry and Phi 3 Mini 4k Instruct June 2024 has 15.

Related comparisons

Go deeper