VERIFIED AI BENCHMARK
MMMU Leaderboard
Explore verified MMMU AI benchmark results, rankings, methodology, sources and tested models on AI Orbit.
Multimodal · % · Higher is better · Version 2025 · validation; extended thinking reported
Only verified results are included in this public leaderboard.
Only verified results are included in this public leaderboard.
| # | Model / Tool | Score | Tested | Source |
|---|---|---|---|---|
| 1 | GPT-5 | 84.20 % | Aug 7, 2025 | OpenAI GPT-5 developer announcement |
| 2 | o3 | 82.90 % | Aug 7, 2025 | OpenAI GPT-5 developer announcement |
| 3 | o4-mini | 81.60 % | Aug 7, 2025 | OpenAI GPT-5 developer announcement |
| 4 | GPT-5 mini | 81.60 % | Aug 7, 2025 | OpenAI GPT-5 developer announcement |
| 5 | Claude Opus 4 | 76.50 % | May 22, 2025 | Anthropic Claude 4 announcement |
| 6 | GPT-5 nano | 75.60 % | Aug 7, 2025 | OpenAI GPT-5 developer announcement |
| 7 | Claude 3.7 Sonnet | 75.00 % | May 22, 2025 | Anthropic Claude 4 announcement |
| 8 | GPT-4.1 | 74.80 % | Aug 7, 2025 | OpenAI GPT-5 developer announcement |
| 9 | Claude Sonnet 4 | 74.40 % | May 22, 2025 | Anthropic Claude 4 announcement |
| 10 | GPT-4.1 mini | 72.70 % | Aug 7, 2025 | OpenAI GPT-5 developer announcement |
| 11 | GPT-4o | 68.70 % | Apr 14, 2025 | OpenAI GPT-4.1 announcement |
| 12 | GPT-4o mini | 56.30 % | Apr 14, 2025 | OpenAI GPT-4.1 announcement |
| 13 | GPT-4.1 nano | 55.40 % | Aug 7, 2025 | OpenAI GPT-5 developer announcement |
About MMMU
This leaderboard uses the latest verified result available for each listed entity. Results retain their source and test date so readers can evaluate freshness and methodology.