Skip to content
Bencher

TestsBenchmarks · Coding

Kimi Code Bench v2 (internal)

Moonshot in-house realistic coding-agent benchmark across 10+ languages (vendor-internal).

% solvedHigher is betterThe test's websiteOfficial page ↗

The best 3 · 3 models tested

Top 3 · best setting per model · 3 models, 3 results (0 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
Kimi Code Bench v2 (internal) leaderboard
Thinking levelSetting
1Kimi K3Moonshot AI (Kimi)72.9%Maxreasoning_effort=maxMaker's own figureVendor-reportedMoonshot AI ↗Kimi Code16 Jul 2026
2Kimi K2.7 CodeMoonshot AI (Kimi)62.0%DefaultthinkingMaker's own figureVendor-reportedMoonshot AI ↗Kimi Code CLI12 Jun 2026
3Kimi K2.6Moonshot AI (Kimi)50.9%DefaultthinkingMaker's own figureVendor-reportedMoonshot AI ↗Kimi Code CLI12 Jun 2026