FACTS Benchmark Suite: Systematically evaluating the factuality of large language models

FACTS Benchmark Suite: Systematically evaluating the factuality of large language models
FACTS Grounding: A new benchmark for evaluating the factuality of large language modelsDecember 2024Responsibility & Safety Learn more

Source: DeepMind — Published — Category: Research

🔗 Read full article on DeepMind →