Skip to content
Bencher

TestsBenchmarks · Reasoning

ARC-AGI-1

Abstract visual reasoning puzzles (v1).

% solvedHigher is betterToo easy now: the top models all score near perfectSaturatedThe test's websiteOfficial page ↗

The best 7 · 7 models tested

Top 7 · best setting per model · 7 models, 7 results (0 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
ARC-AGI-1 leaderboard
Thinking levelSetting
1Claude Fable 5Anthropic98.5%Maxadaptive thinking, effort=maxMaker's own figureVendor-reportedAnthropic ↗—1 Sep 2026
2GPT-6 AstraOpenAI98.5%Defaultbest score across efforts (OpenAI table: "maximum at any effort")Maker's own figureVendor-reportedOpenAI ↗—3 Sep 2026
3Claude Opus 5Anthropic97.5%Maxadaptive thinking, effort=maxMaker's own figureVendor-reportedAnthropic ↗—24 Jul 2026
4Claude Fable 5.1Anthropic97.5%Maxadaptive thinking, effort=maxMaker's own figureVendor-reportedAnthropic ↗—1 Sep 2026
5GPT-5.6 SolOpenAI97.5%Defaultbest score across efforts (OpenAI table: "maximum at any effort")Maker's own figureVendor-reportedOpenAI ↗—3 Sep 2026
6GPT-5.5OpenAI95.0%Extra highreasoning effort=xhighMaker's own figureVendor-reportedOpenAI ↗—23 Apr 2026
7Claude Opus 4.8Anthropic92.5%Maxadaptive thinking, effort=maxMaker's own figureVendor-reportedAnthropic ↗—24 Jul 2026