Coding benchmark
ALE-Bench leaderboard
As of October 2026, GPT-6 Astra has the highest published ALE-Bench score on Noometry at 2,951, out of 105 models with results.
Last verified
About ALE-Bench
Hard optimization problems from AtCoder Heuristic Contests, scored with a contest-style performance rating.
- Introduced
- 2025
- Format
- Heuristic optimization
- Unit
- Raw score
Top 15 models
Top models on ALE-Bench - GPT-6 Astra 2,951
- GPT-6 Sol 2,462
- GPT-5.6 Sol 2,177
- Claude Opus 5 2,165
- Claude Opus 5.5 2,147
- Claude Fable 5.1 2,143
- Claude Fable 5 2,041
- GPT-5.6 Terra 1,951
- GPT-5.5 1,943
- Claude Sonnet 5.5 1,819
- GPT-5.6 Luna 1,667
- GPT-5.3 Codex 1,655
- GPT-5.4 1,607
- GPT-6 Luna 1,577
- Claude Opus 4.8 1,564
- 10001500200025003000
Sponsored placements are available on pages like this one. Advertise on Noometry
All results
ALE-Bench results by model| # | Model | Provider | Rating | Setting | Source | Date |
|---|
| 1 | GPT-6 Astra | OpenAI | 2,951 | max | Epoch AI | |
| 2 | GPT-6 Sol | OpenAI | 2,462 | max | Epoch AI | |
| 3 | GPT-5.6 Sol | OpenAI | 2,177 | max | Epoch AI | |
| 4 | Claude Opus 5 | Anthropic | 2,165 | high | Epoch AI | |
| 5 | Claude Opus 5.5 | Anthropic | 2,147 | high | Epoch AI | |
| 6 | Claude Fable 5.1 | Anthropic | 2,143 | high | Epoch AI | |
| 7 | Claude Fable 5 | Anthropic | 2,041 | high | Epoch AI | |
| 8 | GPT-5.6 Terra | OpenAI | 1,951 | max | Epoch AI | |
| 9 | GPT-5.5 | OpenAI | 1,943 | xhigh | Epoch AI | |
| 10 | Claude Sonnet 5.5 | Anthropic | 1,819 | high | Epoch AI | |
| 11 | GPT-5.6 Luna | OpenAI | 1,667 | max | Epoch AI | |
| 12 | GPT-5.3 Codex | OpenAI | 1,655 | xhigh | Epoch AI | |
| 13 | GPT-5.4 | OpenAI | 1,607 | high | Epoch AI | |
| 14 | GPT-6 Luna | OpenAI | 1,577 | xhigh | Epoch AI | |
| 15 | Claude Opus 4.8 | Anthropic | 1,564 | high | Epoch AI | |
| 16 | Kimi K3 | Moonshot AI | 1,524 | max | Epoch AI | |
| 17 | Grok 4.6 | xAI | 1,508 | xhigh | Epoch AI | |
| 18 | Claude Sonnet 5 | Anthropic | 1,463 | high | Epoch AI | |
| 19 | DeepSeek V4 Pro | DeepSeek | 1,403 | max | Epoch AI | |
| 20 | Gemini 3 Flash Preview | Google | 1,367 | | Epoch AI | |
| 21 | Claude Sonnet 4.6 | Anthropic | 1,327 | medium | Epoch AI | |
| 22 | Claude Opus 4.7 | Anthropic | 1,323 | | Epoch AI | |
| 23 | GLM-5.3 | Z.ai (Zhipu) | 1,317 | high | Epoch AI | |
| 24 | Grok 4.5 | xAI | 1,309 | high | Epoch AI | |
| 25 | DeepSeek V4 Flash | DeepSeek | 1,306 | max | Epoch AI | |
| 26 | GPT-5.2 Codex | OpenAI | 1,300 | | Epoch AI | |
| 27 | GPT-5.2 | OpenAI | 1,294 | high | Epoch AI | |
| 28 | Gemini 3.8 Flash | Google | 1,270 | high | Epoch AI | |
| 29 | GPT-5.1-Codex | OpenAI | 1,245 | | Epoch AI | |
| 30 | GPT-5.1 | OpenAI | 1,192 | high | Epoch AI | |
| 31 | Qwen3.7 Max | Alibaba (Qwen) | 1,189 | | Epoch AI | |
| 32 | GPT-5.4 mini | OpenAI | 1,189 | high | Epoch AI | |
| 33 | Gemini 3 Pro | Google | 1,177 | | Epoch AI | |
| 34 | GPT-5 | OpenAI | 1,162 | high | Epoch AI | |
| 35 | Gemini 3.1 Pro Preview | Google | 1,161 | | Epoch AI | |
| 36 | MiMo-V2.6-Pro | Xiaomi | 1,158 | | Epoch AI | |
| 37 | Grok 4.20 (Non-Reasoning) | xAI | 1,150 | | Epoch AI | |
| 38 | Kimi K2.6 | Moonshot AI | 1,093 | | Epoch AI | |
| 39 | DeepSeek V4.1 Flash | DeepSeek | 1,092 | max | Epoch AI | |
| 40 | GLM-5.2 | Z.ai (Zhipu) | 1,047 | high | Epoch AI | |
| 41 | Claude Opus 4.5 | Anthropic | 1,025 | 16K | Epoch AI | |
| 42 | GPT-5.4 nano | OpenAI | 1,005 | high | Epoch AI | |
| 43 | Claude Opus 4.6 | Anthropic | 996.5 | | Epoch AI | |
| 44 | Inkling | T Thinking Machines Lab | 946 | | Epoch AI | |
| 45 | Grok 4.3 | xAI | 944.17 | | Epoch AI | |
| 46 | o3 | OpenAI | 933.55 | high | Epoch AI | |
| 47 | Gemma 4 26B A4B IT | Google | 927.17 | | Epoch AI | |
| 48 | Gemma 4 31B IT | Google | 925.5 | | Epoch AI | |
| 49 | Gemini 3.5 Flash | Google | 911.02 | high | Epoch AI | |
| 50 | Gemini 3.7 Flash | Google | 904.3 | high | Epoch AI | |
| 51 | MiMo-V2.5-Pro | Xiaomi | 899.8 | | Epoch AI | |
| 52 | GLM-5.1 | Z.ai (Zhipu) | 887.1 | | Epoch AI | |
| 53 | Kimi K2.7 Code | Moonshot AI | 886.23 | | Epoch AI | |
| 54 | o4-mini | OpenAI | 826.17 | high | Epoch AI | |
| 55 | Kimi K2.5 | Moonshot AI | 821.65 | | Epoch AI | |
| 56 | DeepSeek-R1 | DeepSeek | 804.12 | | Epoch AI | |
| 57 | GPT-5 Mini | OpenAI | 799.77 | high | Epoch AI | |
| 58 | Gemini 3.1 Flash Lite | Google | 797.73 | | Epoch AI | |
| 59 | Claude Sonnet 4.5 | Anthropic | 796.15 | 32K | Epoch AI | |
| 60 | Mercury 2 | Inception | 785.58 | | Epoch AI | |
| 61 | Gemini 2.5 Pro | Google | 785.52 | 32K | Epoch AI | |
| 62 | MiMo-V2-Pro | Xiaomi | 785.17 | | Epoch AI | |
| 63 | GLM-5 | Z.ai (Zhipu) | 765.62 | | Epoch AI | |
| 64 | Gemini 3.5 Flash Lite | Google | 765.27 | high | Epoch AI | |
| 65 | Mistral Medium | Mistral AI | 763.98 | | Epoch AI | |
| 66 | DeepSeek-V3.1-Terminus | DeepSeek | 745.17 | | Epoch AI | |
| 67 | MiMo-V2-Flash | Xiaomi | 737.95 | | Epoch AI | |
| 68 | GPT-5 Nano | OpenAI | 718.67 | high | Epoch AI | |
| 69 | Gemini 3.6 Flash | Google | 715.52 | high | Epoch AI | |
| 70 | Step 3.7 Flash | StepFun | 694.12 | | Epoch AI | |
| 71 | Claude Opus 4.1 | Anthropic | 674.77 | 16K | Epoch AI | |
| 72 | Qwen3.6 Plus | Alibaba (Qwen) | 670.15 | | Epoch AI | |
| 73 | Gemini 2.5 Flash | Google | 661.88 | | Epoch AI | |
| 74 | Claude Sonnet 4 | Anthropic | 655.35 | 32K | Epoch AI | |
| 75 | Claude Haiku 4.5 | Anthropic | 653.48 | 32K | Epoch AI | |
| 76 | MiniMax-M3 | MiniMax | 640.02 | | Epoch AI | |
| 77 | MiniMax-M2.1 | MiniMax | 623.83 | | Epoch AI | |
| 78 | Qwen3.5 Plus | Alibaba (Qwen) | 621.92 | | Epoch AI | |
| 79 | MiniMax-M2.5 | MiniMax | 618.17 | | Epoch AI | |
| 80 | MiniMax-M2.7 | MiniMax | 599.25 | | Epoch AI | |
| 81 | Kimi K2 (Jul 2025) | Moonshot AI | 597.5 | | Epoch AI | |
| 82 | gpt-oss-120b | OpenAI | 575.62 | | Epoch AI | |
| 83 | gpt-oss-20b | OpenAI | 566.05 | | Epoch AI | |
| 84 | GPT-4.1 | OpenAI | 558.1 | | Epoch AI | |
| 85 | MiMo-V2.5 | Xiaomi | 513.95 | | Epoch AI | |
| 86 | Mistral Small | Mistral AI | 497.62 | | Epoch AI | |
| 87 | Qwen3-Coder 480B-A35B Instruct | Alibaba (Qwen) | 461.45 | | Epoch AI | |
| 88 | Qwen3 Coder Plus | Alibaba (Qwen) | 456.5 | | Epoch AI | |
| 89 | Ring-2.6-1T | Ant Group (inclusionAI) | 432.57 | | Epoch AI | |
| 90 | GLM-4.7 | Z.ai (Zhipu) | 399.48 | | Epoch AI | |
| 91 | Grok 4.1 Fast | xAI | 394.93 | | Epoch AI | |
| 92 | Qwen3 Max | Alibaba (Qwen) | 370.45 | | Epoch AI | |
| 93 | Qwen3.5 27B | Alibaba (Qwen) | 349.45 | | Epoch AI | |
| 94 | GLM-4.5 | Z.ai (Zhipu) | 344.82 | | Epoch AI | |
| 95 | GLM-4.6 | Z.ai (Zhipu) | 340.82 | | Epoch AI | |
| 96 | Qwen3.6 Flash | Alibaba (Qwen) | 326.4 | | Epoch AI | |
| 97 | Gemini 2.5 Flash-Lite | Google | 325.9 | | Epoch AI | |
| 98 | GLM-5.3-Flash | Z.ai (Zhipu) | 303.55 | high | Epoch AI | |
| 99 | Mercury 2.5 | Inception | 301.65 | high | Epoch AI | |
| 100 | Mistral Large | Mistral AI | 264.7 | | Epoch AI | |
| 101 | Amazon Nova Lite | Amazon | 236.25 | | Epoch AI | |
| 102 | Qwen3.5-Flash | Alibaba (Qwen) | 221.8 | | Epoch AI | |
| 103 | Nemotron 3 Super | NVIDIA | 213.9 | | Epoch AI | |
| 104 | Llama 4 Maverick | Meta | 172.97 | | Epoch AI | |
| 105 | Codestral | Mistral AI | 137.78 | | Epoch AI | |
Frequently asked questions
What does ALE-Bench measure?
Hard optimization problems from AtCoder Heuristic Contests, scored with a contest-style performance rating.
Which model has the highest ALE-Bench score?
As of October 2026, GPT-6 Astra has the highest published ALE-Bench score on Noometry at 2,951, out of 105 models with results.
What is the best open-weight model on ALE-Bench?
Kimi K3 has the highest ALE-Bench score among open-weight models at 1,524, ranking 16 of 105 overall.