Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies

Yuxuan Ye; Raul Santos-Rodriguez; Edwin Simpson

doi:10.18653/v1/2026.acl-long.1468

Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies

Yuxuan Ye, Raul Santos-Rodriguez, Edwin Simpson

Abstract

Grounded claim factuality checking is important for large language model (LLM) applications such as retrieval-augmented generation, as it helps users assess the correctness of generated outputs. Existing metrics using entailment classifiers require dataset-specific threshold tuning, while LLM-based approaches often use direct prompting, which underutilises the reasoning capabilities of LLMs. We address this by formulating grounded claim factuality checking as a true/false reading comprehension task and prompting LLMs with explicit test-taking strategies for efficient reasoning. Our method reduces token usage by over 80% compared to unguided open-ended reasoning, and achieves competitive performance to more expensive alternatives across two factuality benchmarks, setting a new state of the art on one. To further reduce inference cost, we train small language models (SLMs) to replace LLMs in the checking pipeline. Using supervised fine-tuning (SFT) and a self-revision mechanism, the SLMs learn to improve their factuality judgements. Experimental results show that the resulting SLMs perform on par with strong baselines, combining low inference costs with generating supporting rationales to support interpretability. Code and datasets will be released upon acceptance.

Anthology ID:: 2026.acl-long.1468
Volume:: Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers)
Month:: July
Year:: 2026
Address:: San Diego, California, United States
Editors:: Maria Liakata, Viviane P. Moreira, Jiajun Zhang, David Jurgens
Venue:: ACL
SIG:
Publisher:: Association for Computational Linguistics
Note:
Pages:: 31818–31834
Language:
URL:: https://aclanthology.org/2026.acl-long.1468/
DOI:: 10.18653/v1/2026.acl-long.1468
Bibkey:
Cite (ACL):: Yuxuan Ye, Raul Santos-Rodriguez, and Edwin Simpson. 2026. Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies. In Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), pages 31818–31834, San Diego, California, United States. Association for Computational Linguistics.
Cite (Informal):: Teaching Language Models to Check Grounded Claim Factuality with Human Test-Taking Strategies (Ye et al., ACL 2026)
Copy Citation:
PDF:: https://aclanthology.org/2026.acl-long.1468.pdf
Checklist:: 2026.acl-long.1468.checklist.pdf

PDF Cite Search Checklist Fix data