AI OrbitExplore • Compare • Stay Ahead
VERIFIED AI BENCHMARK

MMMU Leaderboard

Explore verified MMMU AI benchmark results, rankings, methodology, sources and tested models on AI Orbit.

Multimodal · % · Higher is better · Version 2025 · validation; extended thinking reported
Only verified results are included in this public leaderboard.

Official methodology / benchmark source

#Model / ToolScoreTestedSource
1GPT-584.20 %Aug 7, 2025OpenAI GPT-5 developer announcement
2o382.90 %Aug 7, 2025OpenAI GPT-5 developer announcement
3o4-mini81.60 %Aug 7, 2025OpenAI GPT-5 developer announcement
4GPT-5 mini81.60 %Aug 7, 2025OpenAI GPT-5 developer announcement
5Claude Opus 476.50 %May 22, 2025Anthropic Claude 4 announcement
6GPT-5 nano75.60 %Aug 7, 2025OpenAI GPT-5 developer announcement
7Claude 3.7 Sonnet75.00 %May 22, 2025Anthropic Claude 4 announcement
8GPT-4.174.80 %Aug 7, 2025OpenAI GPT-5 developer announcement
9Claude Sonnet 474.40 %May 22, 2025Anthropic Claude 4 announcement
10GPT-4.1 mini72.70 %Aug 7, 2025OpenAI GPT-5 developer announcement
11GPT-4o68.70 %Apr 14, 2025OpenAI GPT-4.1 announcement
12GPT-4o mini56.30 %Apr 14, 2025OpenAI GPT-4.1 announcement
13GPT-4.1 nano55.40 %Aug 7, 2025OpenAI GPT-5 developer announcement

About MMMU

This leaderboard uses the latest verified result available for each listed entity. Results retain their source and test date so readers can evaluate freshness and methodology.