MMLU-Pro first-party comparison snapshot leaderboard
6 ranked models · higher is better
View accessible chart data
| Model | Rank | Provider | Score |
|---|---|---|---|
| Claude Opus 4.6 | #1 | Anthropic | 89.1% |
| Kimi K2.5 | #2 | Moonshot AI | 87.1% |
| GLM-5 | #3 | Z.AI | 85.8% |
| Trinity-Large-Thinking | #4 | Arcee AI | 83.4% |
| MiniMax M2.7 | #5 | MiniMax | 80.8% |
| Trinity-Large-Preview | #6 | Arcee AI | 75.2% |

