Skip to content
Bencher

TestsBenchmarks · Math

FrontierMath Tier 1-3

Epoch AI research-level math problems, tiers 1-3.

% solvedHigher is betterThe test's websiteOfficial page ↗

The best 5 · 5 models tested

Top 5 · best setting per model · 5 models, 6 results (0 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
FrontierMath Tier 1-3 leaderboard
Thinking levelSetting
1GPT-5.6 SolOpenAI89.0%DefaultGPT-5.6 launch table (effort not stated; text cites max for headline results)Maker's own figureVendor-reportedOpenAI ↗—9 Jul 2026
2GPT-5.5OpenAI85.3%DefaultGPT-5.6 launch table (effort not stated; text cites max for headline results)Maker's own figureVendor-reportedOpenAI ↗—9 Jul 2026
3GPT-5.6 TerraOpenAI84.9%DefaultGPT-5.6 launch table (effort not stated; text cites max for headline results)Maker's own figureVendor-reportedOpenAI ↗—9 Jul 2026
4GPT-5.6 LunaOpenAI78.6%DefaultGPT-5.6 launch table (effort not stated; text cites max for headline results)Maker's own figureVendor-reportedOpenAI ↗—9 Jul 2026
5GPT-5.5 ProOpenAI52.4%Extra highGPT-5.5 Pro, reasoning effort=xhighMaker's own figureVendor-reportedOpenAI ↗—23 Apr 2026