Skip to content
Bencher

TestsBenchmarks · Multimodal

MMMU-Pro (with tools)

MMMU-Pro with tool use.

% solvedHigher is betterThe test's websiteOfficial page ↗

The best 4 · 4 models tested

Top 4 · best setting per model · 4 models, 5 results (0 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
MMMU-Pro (with tools) leaderboard
Thinking levelSetting
1GPT-5.6 SolOpenAI84.6%DefaultGPT-5.6 launch table (effort not stated; text cites max for headline results)Maker's own figureVendor-reportedOpenAI ↗—9 Jul 2026
2GPT-5.5OpenAI83.2%DefaultGPT-5.6 launch table (effort not stated; text cites max for headline results)Maker's own figureVendor-reportedOpenAI ↗—9 Jul 2026
3GPT-5.6 TerraOpenAI82.0%DefaultGPT-5.6 launch table (effort not stated; text cites max for headline results)Maker's own figureVendor-reportedOpenAI ↗—9 Jul 2026
4GPT-5.6 LunaOpenAI79.5%DefaultGPT-5.6 launch table (effort not stated; text cites max for headline results)Maker's own figureVendor-reportedOpenAI ↗—9 Jul 2026