MMMU-Pro with Python leaderboard
9 ranked models · higher is better
View accessible chart data
| Model | Rank | Provider | Score |
|---|---|---|---|
| GPT-5.6 Sol | #1 | OpenAI | 84.6% |
| Kimi K3 | #2 | Moonshot AI | 83.4% |
| GPT-5.5 | #3 | OpenAI | 83.2% |
| GPT-5.4 | #4 | OpenAI | 82.1% |
| GPT-5.6 Terra | #5 | OpenAI | 82% |
| Kimi K2.6 | #6 | Moonshot AI | 80.1% |
| GPT-5.6 Luna | #7 | OpenAI | 79.5% |
| GPT-5.4 mini | #8 | OpenAI | 78% |
| GPT-5.4 nano | #9 | OpenAI | 69.5% |

