FrontierMath v2 Tiers 1-3 leaderboard
20 ranked models · higher is better
View accessible chart data
| Model | Rank | Provider | Score |
|---|---|---|---|
| GPT-5.6 Sol | #1 | OpenAI | 89% |
| GPT-5.6 Terra | #2 | OpenAI | 84.9% |
| GPT-5.6 Luna | #3 | OpenAI | 78.6% |
| GPT-5.5 | #4 | OpenAI | 51.7% |
| GPT-5.5 Pro | #5 | OpenAI | 51% |
| GPT-5.4 Pro | #6 | OpenAI | 50% |
| GPT-5.4 | #7 | OpenAI | 47.6% |
| Claude Opus 4.8 | #8 | Anthropic | 47.2% |
| Claude Opus 4.7 | #9 | Anthropic | 43.8% |
| Claude Opus 4.6 | #10 | Anthropic | 40.7% |
| GPT-5.2 | #11 | OpenAI | 40.7% |
| Muse Spark | #12 | Meta | 39% |
| Gemini 3.5 Flash | #13 | 39.0% | |
| Kimi K2.6 | #14 | Moonshot AI | 39.0% |
| Gemini 3 Pro | #15 | 37.6% | |
| Gemini 3.1 Pro | #16 | 36.9% | |
| Gemini 3 Flash | #17 | 35.6% | |
| GLM-5.1 | #18 | Z.AI | 33.4% |
| Claude Sonnet 4.6 | #19 | Anthropic | 32.4% |
| GPT-5.1 | #20 | OpenAI | 31.0% |

