Skip to content
Bencher

TestsBenchmarks · Math

HMMT February 2026

Share of problems from the Harvard-MIT Mathematics Tournament (Feb 2026) a model answers correctly.

% solvedHigher is betterThe test's websiteOfficial page ↗

The best 9 · 9 models tested

Top 9 · best setting per model · 9 models, 13 results (0 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
HMMT February 2026 leaderboard
Thinking levelSetting
1Qwen3.7 MaxQwen (Alibaba)97.1%Defaultthinking (vendor recommends 'Reasoning effort is set to xhigh' system prompt for reasoning tasks)Maker's own figureVendor-reportedQwen (Alibaba) ↗—16 May 2026
2DeepSeek V4 Pro (Preview, 0423)DeepSeek95.2%MaxThink MaxMaker's own figureVendor-reportedDeepSeek ↗—24 Apr 2026
3DeepSeek V4 Flash (Preview, 0423)DeepSeek94.8%MaxThink MaxMaker's own figureVendor-reportedDeepSeek ↗—24 Apr 2026
4Qwen3.7 PlusQwen (Alibaba)92.9%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗—21 May 2026
5Kimi K2.6Moonshot AI (Kimi)92.7%DefaultthinkingMaker's own figureVendor-reportedMoonshot AI ↗—20 Apr 2026
6GLM-5.2Z.ai (Zhipu)92.5%Defaultthinking (effort not stated)Maker's own figureVendor-reportedZ.ai ↗—16 Jun 2026
7Qwen3.6 PlusQwen (Alibaba)87.8%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗—2 Apr 2026
8Qwen3.6 27BQwen (Alibaba)84.3%DefaultthinkingMaker's own figureVendor-reportedQwen (Alibaba) ↗—22 Apr 2026
9GLM-5.1Z.ai (Zhipu)82.6%DefaultthinkingMaker's own figureVendor-reportedZ.ai ↗—7 Apr 2026