Skip to content
Bencher

TestsBenchmarks · Coding

CursorBench 3.2.0

Earlier CursorBench release; not comparable to 4.0.

% solvedHigher is betterCounts toward:Weights: Coding ×0.6The test's websiteOfficial page ↗

The best 6 · 6 models tested

Top 6 · best setting per model · 6 models, 14 results (1 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
CursorBench 3.2.0 leaderboard
Thinking levelSetting
1Claude Fable 5.1Anthropic73.4%Maxadaptive thinking, effort=maxMaker's own figureVendor-reportedAnthropic ↗Cursor agent1 Sep 2026
2Claude Fable 5Anthropic70.5%Maxadaptive thinking, effort=maxMaker's own figureVendor-reportedAnthropic ↗Cursor agent1 Sep 2026
3Claude Opus 5Anthropic70.0%Maxadaptive thinking, effort=maxMaker's own figureVendor-reportedAnthropic ↗Cursor agent1 Sep 2026
4Grok 4.6SpaceXAI (formerly xAI)69.9%HighMaker's own figureVendor-reportedSpaceXAI ↗—12 Aug 2026
5GPT-5.6 SolOpenAI67.2%Maxreasoning effort=maxIndependent testIndependentCursor (via Anthropic launch post) ↗Cursor agent1 Sep 2026
6Grok 4.5SpaceXAI (formerly xAI)66.7%HighMaker's own figureVendor-reportedSpaceXAI ↗—12 Aug 2026