Skip to content
Bencher

TestsBenchmarks · Math

AIME 2026

2026 American Invitational Mathematics Examination, no tools.

% solvedHigher is betterThe test's websiteOfficial page ↗

The best 8 · 8 models tested

Top 8 · best setting per model · 8 models, 8 results (0 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
AIME 2026 leaderboard
Thinking levelSetting
1GLM-5.2Z.ai (Zhipu)99.2%Defaultthinking (effort not stated)Maker's own figureVendor-reportedZ.ai ↗—16 Jun 2026
2Kimi K2.6Moonshot AI (Kimi)96.4%DefaultthinkingMaker's own figureVendor-reportedMoonshot AI ↗—20 Apr 2026
3Qwen3.6 PlusQwen (Alibaba)95.3%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗—2 Apr 2026
4GLM-5.1Z.ai (Zhipu)95.3%DefaultthinkingMaker's own figureVendor-reportedZ.ai ↗—7 Apr 2026
5Muse Glimmer 30BMeta (Meta Superintelligence Labs, Muse)94.7%HighHigh reasoningMaker's own figureVendor-reportedMeta ↗—10 Aug 2026
6Qwen3.6 27BQwen (Alibaba)94.1%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗—22 Apr 2026
7Gemma 4 31B ITGoogle (Gemini / DeepMind)89.2%DefaultThinkingMaker's own figureVendor-reportedGoogle ↗—2 Apr 2026
8Gemma 4 26B A4B ITGoogle (Gemini / DeepMind)88.3%DefaultThinkingMaker's own figureVendor-reportedGoogle ↗—2 Apr 2026