TestsBenchmarks · Knowledge
FACTS Benchmark Suite
Factuality across grounding, parametric, search and multimodal.
% solvedHigher is betterCounts toward:Weights: Research & analysis ×0.6The test's websiteOfficial page ↗
Measured by independent testersIndependent Reported by the makerVendor-reported
| Thinking levelSetting | |||||||
|---|---|---|---|---|---|---|---|
| 1 | Gemini 3.1 Flash-Lite | Google (Gemini / DeepMind) | 40.6% | High | Maker's own figureVendor-reportedGoogle ↗ | — | 3 Mar 2026 |