Skip to content
Bencher

TestsBenchmarks · Coding

SWE-rebench

Resolve rate on fresh, decontaminated GitHub issues collected in a rolling time window, run with one standard scaffold.

% solvedHigher is betterCounts toward:Weights: Coding ×0.6The test's websiteOfficial page ↗

The best 13 · 13 models tested

Top 13 · best setting per model · 13 models, 13 results (13 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
SWE-rebench leaderboard
Thinking levelSetting
1Claude Fable 5Anthropic64.5%HighFable 5 [high]Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
2Grok 4.5SpaceXAI (formerly xAI)63.8%HighGrok 4.5 [high]Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
3Claude Opus 5Anthropic63.4%HighOpus 5 [high]Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
4GLM-5.2Z.ai (Zhipu)62.9%HighGLM-5.2 [high]Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
5GPT-5.6 SolOpenAI62.3%MediumGPT-5.6 Sol [medium]Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
6Claude Sonnet 5Anthropic56.8%HighSonnet 5 [high]Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
7MiniMax M3MiniMax47.2%DefaultMiniMax M3Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
8MiMo-V2.5-ProXiaomi MiMo46.5%DefaultMiMo V2.5 ProIndependent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
9GPT-5.6 LunaOpenAI43.6%MediumGPT-5.6 Luna [medium]Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
10DeepSeek V4 Pro (Preview, 0423)DeepSeek40.2%HighDeepSeek-V4 Pro [high]Independent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
11Qwen3.6 27BQwen (Alibaba)31.2%DefaultQwen3.6-27BIndependent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
12Qwen3.6 35B A3BQwen (Alibaba)24.7%DefaultQwen3.6-35B-A3BIndependent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026
13Qwen3.5-35B-A3BQwen (Alibaba)17.1%DefaultQwen3.5-35B-A3BIndependent testIndependentSWE-rebench (Nebius) ↗SWE-rebench standard scaffold1 Oct 2026