TestsBenchmarks · Math
HMMT February 2026
Share of problems from the Harvard-MIT Mathematics Tournament (Feb 2026) a model answers correctly.
Measured by independent testersIndependent Reported by the makerVendor-reported
| Thinking levelSetting | |||||||
|---|---|---|---|---|---|---|---|
| 1 | Qwen3.7 Max | Qwen (Alibaba) | 97.1% | Defaultthinking (vendor recommends 'Reasoning effort is set to xhigh' system prompt for reasoning tasks) | Maker's own figureVendor-reportedQwen (Alibaba) ↗ | — | 16 May 2026 |
| 2 | DeepSeek V4 Pro (Preview, 0423) | DeepSeek | 95.2% | MaxThink Max | Maker's own figureVendor-reportedDeepSeek ↗ | — | 24 Apr 2026 |
| 3 | DeepSeek V4 Flash (Preview, 0423) | DeepSeek | 94.8% | MaxThink Max | Maker's own figureVendor-reportedDeepSeek ↗ | — | 24 Apr 2026 |
| 4 | Qwen3.7 Plus | Qwen (Alibaba) | 92.9% | Defaultthinking | Maker's own figureVendor-reportedQwen (Alibaba) ↗ | — | 21 May 2026 |
| 5 | Kimi K2.6 | Moonshot AI (Kimi) | 92.7% | Defaultthinking | Maker's own figureVendor-reportedMoonshot AI ↗ | — | 20 Apr 2026 |
| 6 | GLM-5.2 | Z.ai (Zhipu) | 92.5% | Defaultthinking (effort not stated) | Maker's own figureVendor-reportedZ.ai ↗ | — | 16 Jun 2026 |
| 7 | Qwen3.6 Plus | Qwen (Alibaba) | 87.8% | Defaultthinking | Maker's own figureVendor-reportedQwen (Alibaba) ↗ | — | 2 Apr 2026 |
| 8 | Qwen3.6 27B | Qwen (Alibaba) | 84.3% | Defaultthinking | Maker's own figureVendor-reportedQwen (Alibaba) ↗ | — | 22 Apr 2026 |
| 9 | GLM-5.1 | Z.ai (Zhipu) | 82.6% | Defaultthinking | Maker's own figureVendor-reportedZ.ai ↗ | — | 7 Apr 2026 |