FrontierMath v2 Tier 4 leaderboard
20 ranked models · higher is better
View accessible chart data
| Model | Rank | Provider | Score |
|---|---|---|---|
| GPT-5.6 Sol | #1 | OpenAI | 83% |
| GPT-5.6 Terra | #2 | OpenAI | 68.3% |
| GPT-5.6 Luna | #3 | OpenAI | 58.5% |
| GPT-5.5 Pro | #4 | OpenAI | 39.6% |
| GPT-5.4 Pro | #5 | OpenAI | 37.5% |
| GPT-5.5 | #6 | OpenAI | 35.4% |
| Claude Opus 4.8 | #7 | Anthropic | 31.3% |
| GPT-5.4 | #8 | OpenAI | 27.1% |
| Claude Opus 4.7 | #9 | Anthropic | 22.9% |
| Claude Opus 4.6 | #10 | Anthropic | 22.9% |
| GPT-5.2 | #11 | OpenAI | 18.8% |
| Gemini 3 Pro | #12 | 18.8% | |
| Gemini 3.1 Pro | #13 | 16.7% | |
| Muse Spark | #14 | Meta | 14.6% |
| Gemini 3.5 Flash | #15 | 14.6% | |
| Kimi K2.6 | #16 | Moonshot AI | 14.6% |
| GLM-5.1 | #17 | Z.AI | 12.5% |
| GPT-5.1 | #18 | OpenAI | 12.5% |
| Qwen3.6 Plus | #19 | Alibaba Cloud | 8.3% |
| Claude Sonnet 4.6 | #20 | Anthropic | 8.3% |

