Model comparison

Claude 3.5 Haiku vs Claude 3 Sonnet

Claude 3.5 Haiku and Claude 3 Sonnet score almost the same on the Noometry Index (29.2 vs 29.0), so choose on price, context window or the category you care about most.

Last verified . 27 shared benchmarks.

Claude 3.5 Haiku Anthropic

29.2

Rank #315 Confirmed

Claude 3 Sonnet Anthropic

29.0

Rank #319 Confirmed

Summary

  • They share 27 benchmarks with published results for both. Claude 3.5 Haiku scores higher in 7 categories and Claude 3 Sonnet in 2 categories; 7 gaps are clear of the uncertainty.
  • The widest gap is in math, where Claude 3.5 Haiku leads 14.7 to 10.7.
  • The biggest single-benchmark swing is MATH Level 5: 46.4% for Claude 3.5 Haiku and 18.2% for Claude 3 Sonnet.

Side by side

Claude 3.5 Haiku and Claude 3 Sonnet specifications
Claude 3.5 HaikuClaude 3 Sonnet
ProviderAnthropicAnthropic
Noometry Index29.229.0
Released2024-10-222024-02-29
WeightsProprietaryProprietary
Context window——
Max output——
Input $ / M tokens——
Output $ / M tokens——
Results tracked4930

Sponsored placements are available on pages like this one. Advertise on Noometry

Category by category

Coding Claude 3.5 Haiku leads

Claude 3.5 Haiku: 32.9 (#265), Claude 3 Sonnet: 29.6 (#302)

Coding benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
WeirdML30.7%10.2%
BigCodeBench Instruct46.1%42.7%
LMArena Coding12861223
BigCodeBench Complete59%53.8%
Aider Polyglot28%—
SciCode27.4%—
LiveBench Coding51.4%—
CadEval32%—
HumanEval+—64%
MBPP+—69.3%

Agentic & Tool Use Not comparable

Claude 3.5 Haiku: 28.0 (#95), Claude 3 Sonnet: —

Agentic & Tool Use benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
BALROG19.3%—

Reasoning Claude 3 Sonnet leads

Claude 3.5 Haiku: 17.7 (#290), Claude 3 Sonnet: 20.5 (#237)

Reasoning benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
LMArena Hard Prompts12511197
DTBench56.7%53.6%
Epoch Capabilities Index127.15120.7
CritPt0%—
LiveBench Reasoning28.1%—
LiveBench Data Analysis48.5%—
LiveBench43.5%—
WinoGrande—75.1%

Math Claude 3.5 Haiku leads

Claude 3.5 Haiku: 14.7 (#300), Claude 3 Sonnet: 10.7 (#310)

Math benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
OTIS Mock AIME 2024-20254.3%2.5%
LMArena Math12441213
MATH Level 546.4%18.2%
Omni-MATH22.4%—
LiveBench Math35.5%—
FrontierMath (Feb 2025 set)0.3%—

Knowledge Claude 3 Sonnet leads

Claude 3.5 Haiku: 18.7 (#281), Claude 3 Sonnet: 21.1 (#276)

Knowledge benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
GPQA Diamond38.1%40.6%
LMArena Expert12081173
MMLU74.3%75.9%
MMLU-Pro60.5%—
Confabulations36.7%—
GPQA (HELM)36.3%—

Multimodal Claude 3.5 Haiku leads

Claude 3.5 Haiku: 26.8 (#117), Claude 3 Sonnet: 25.2 (#125)

Multimodal benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
LMArena Vision1092984
GeoBench34%—

Multilingual Claude 3.5 Haiku leads

Claude 3.5 Haiku: 40.0 (#218), Claude 3 Sonnet: 37.8 (#234)

Multilingual benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
LMArena Non-English12381205
LMArena Chinese12291189
LMArena French12641229
LMArena German12371204
LMArena Japanese11751131
LMArena Korean11731128
LMArena Russian12531227
LMArena Spanish12611204

Instruction Following Too close to call

Claude 3.5 Haiku: 62.9 (#234), Claude 3 Sonnet: 62.8 (#235)

Instruction Following benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
LMArena Instruction Following12411199
LiveBench Instruction Following61.9%—
IFEval79.2%—

Long Context Claude 3.5 Haiku leads

Claude 3.5 Haiku: 38.3 (#200), Claude 3 Sonnet: 36.7 (#228)

Long Context benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
LMArena Longer Query12611211

Writing & Preference Too close to call

Claude 3.5 Haiku: 42.7 (#234), Claude 3 Sonnet: 42.1 (#238)

Writing & Preference benchmarks
BenchmarkClaude 3.5 HaikuClaude 3 Sonnet
LMArena Text12551218
LMArena Creative Writing12331186
LMArena Multi-Turn12651227
Short-Story Creative Writing73.5%—
EQ-Bench Creative Writing1146—
WildBench76%—
LiveBench Language35.4%—

Frequently asked questions

Is Claude 3.5 Haiku better than Claude 3 Sonnet?

Claude 3.5 Haiku and Claude 3 Sonnet score almost the same on the Noometry Index (29.2 vs 29.0), so choose on price, context window or the category you care about most.

Is Claude 3.5 Haiku or Claude 3 Sonnet better for coding?

Claude 3.5 Haiku scores higher on coding benchmarks: 32.9 versus 29.6 in the Noometry coding category.

How many benchmarks do Claude 3.5 Haiku and Claude 3 Sonnet share?

27 benchmarks have published results for both models. Claude 3.5 Haiku has 49 scored results on Noometry and Claude 3 Sonnet has 30.

Related comparisons

Go deeper