Computation and Language · Computer Science
TofuEval: Evaluating Hallucinations of LLMs on Topic-Focused Dialogue Summarization
Liyan Tang, Igor Shalyminov, Amy Wing-mei Wong, Jon Burnsky +10
2024-04-02
Computation and Language · Computer Science
Factuality of Large Language Models: A Survey
Yuxia Wang, Minghan Wang, Muhammad Arslan Manzoor, Fei Liu +3
2024-11-01
Computation and Language · Computer Science
Are Large Language Models Reliable Judges? A Study on the Factuality Evaluation Capabilities of LLMs
Xue-Yong Fu, Md Tahmid Rahman Laskar, Cheng Chen, Shashi Bhushan TN
2023-11-02
Computation and Language · Computer Science
Exploring the Limits of ChatGPT for Query or Aspect-based Text Summarization
Xianjun Yang, Yan Li, Xinlu Zhang, Haifeng Chen +1
2023-02-17
Computation and Language · Computer Science
FELM: Benchmarking Factuality Evaluation of Large Language Models
Shiqi Chen, Yiran Zhao, Jinghan Zhang, I-Chun Chern +3
2023-11-29
Computation and Language · Computer Science
Comprehensiveness Metrics for Automatic Evaluation of Factual Recall in Text Generation
Adam Dejl, James Barry, Alessandra Pascale, Javier Carnerero Cano
2026-05-11
Computation and Language · Computer Science
Survey on Factuality in Large Language Models: Knowledge, Retrieval and Domain-Specificity
Cunxiang Wang, Xiaoze Liu, Yuanhao Yue, Xiangru Tang +12
2023-12-19
Machine Learning · Computer Science
FactSelfCheck: Fact-Level Black-Box Hallucination Detection for LLMs
Albert Sawczyn, Jakub Binkowski, Denis Janiak, Bogdan Gabrys +1
2026-02-02
Computation and Language · Computer Science
Improving Reliability and Explainability of Medical Question Answering through Atomic Fact Checking in Retrieval-Augmented LLMs
Juraj Vladika, Annika Domres, Mai Nguyen, Rebecca Moser +9
2026-01-01
Computation and Language · Computer Science
Evaluating the Factual Consistency of Large Language Models Through News Summarization
Derek Tam, Anisha Mascarenhas, Shiyue Zhang, Sarah Kwan +2
2023-12-05
Computation and Language · Computer Science
Check Your Facts and Try Again: Improving Large Language Models with External Knowledge and Automated Feedback
Baolin Peng, Michel Galley, Pengcheng He, Hao Cheng +7
2023-03-10
Computation and Language · Computer Science
Fact-checking with Generative AI: A Systematic Cross-Topic Examination of LLMs Capacity to Detect Veracity of Political Information
Elizaveta Kuznetsova, Ilaria Vitulano, Mykola Makhortykh, Martha Stolze +2
2025-03-12
Computation and Language · Computer Science
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
Subhey Sadi Rahman, Md. Adnanul Islam, Md. Mahbub Alam, Musarrat Zeba +4
2026-01-06
Computation and Language · Computer Science
FECT: Factuality Evaluation of Interpretive AI-Generated Claims in Contact Center Conversation Transcripts
Hagyeong Shin, Binoy Robin Dalal, Iwona Bialynicka-Birula, Navjot Matharu +3
2025-08-05
Computation and Language · Computer Science
Factuality Enhanced Language Models for Open-Ended Text Generation
Nayeon Lee, Wei Ping, Peng Xu, Mostofa Patwary +3
2023-03-03
Computation and Language · Computer Science
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
Xiaoze Liu, Feijie Wu, Tianyang Xu, Zhuo Chen +3
2024-04-02
Computation and Language · Computer Science
Exploring the Factual Consistency in Dialogue Comprehension of Large Language Models
Shuaijie She, Shujian Huang, Xingyun Wang, Yanke Zhou +1
2024-04-02