Skip to content
Bencher

TestsBenchmarks · Knowledge

FACTS Benchmark Suite

Factuality across grounding, parametric, search and multimodal.

% solvedHigher is betterCounts toward:Weights: Research & analysis ×0.6The test's websiteOfficial page ↗

The best 1 · 1 models tested

Top 1 · best setting per model · 1 models, 1 results (0 independent)

Measured by independent testersIndependent Reported by the makerVendor-reported
FACTS Benchmark Suite leaderboard
Thinking levelSetting
1Gemini 3.1 Flash-LiteGoogle (Gemini / DeepMind)40.6%HighMaker's own figureVendor-reportedGoogle ↗—3 Mar 2026