Computation and Language · Computer Science
FAITH: Factuality Alignment through Integrating Trustworthiness and Honestness
Xiaoning Dong, Chengyan Wu, Yajie Wen, Yu Chen +4
2026-04-14
Computation and Language · Computer Science
CiteVQA: Benchmarking Evidence Attribution for Trustworthy Document Intelligence
Dongsheng Ma, Jiayu Li, Zhengren Wang, Yijie Wang +7
2026-05-14
Computation and Language · Computer Science
BeHonest: Benchmarking Honesty in Large Language Models
Steffi Chern, Zhulin Hu, Yuqing Yang, Ethan Chern +4
2024-07-10
Computation and Language · Computer Science
HonestLLM: Toward an Honest and Helpful Large Language Model
Chujie Gao, Siyuan Wu, Yue Huang, Dongping Chen +5
2024-12-12
Computation and Language · Computer Science
A Survey on the Honesty of Large Language Models
Siheng Li, Cheng Yang, Taiqiang Wu, Chufan Shi +11
2024-09-30
Computer Vision and Pattern Recognition · Computer Science
Mind the Uncertainty in Human Disagreement: Evaluating Discrepancies between Model Predictions and Human Responses in VQA
Jian Lan, Diego Frassinelli, Barbara Plank
2024-10-07
Computer Vision and Pattern Recognition · Computer Science
VeriSciQA: An Auto-Verified Dataset for Scientific Visual Question Answering
Yuyi Li, Daoyuan Chen, Zhen Wang, Yutong Lu +1
2026-02-12
Computer Vision and Pattern Recognition · Computer Science
DocVXQA: Context-Aware Visual Explanations for Document Question Answering
Mohamed Ali Souibgui, Changkyu Choi, Andrey Barsky, Kangsoo Jung +2
2025-05-13
Computation and Language · Computer Science
Performance Gap in Entity Knowledge Extraction Across Modalities in Vision Language Models
Ido Cohen, Daniela Gottesman, Mor Geva, Raja Giryes
2026-01-06
Software Engineering · Computer Science
Showing LLM-Generated Code Selectively Based on Confidence of LLMs
Jia Li, Yuqi Zhu, Yongmin Li, Ge Li +1
2024-10-07
Computer Vision and Pattern Recognition · Computer Science
Uncertainty-Aware Evaluation for Vision-Language Models
Vasily Kostumov, Bulat Nutfullin, Oleg Pilipenko, Eugene Ilyushin
2024-02-27
Computer Vision and Pattern Recognition · Computer Science
Evian: Towards Explainable Visual Instruction-tuning Data Auditing
Zimu Jia, Mingjie Xu, Andrew Estornell, Jiaheng Wei
2026-04-23
Computation and Language · Computer Science
Evaluating Correctness and Faithfulness of Instruction-Following Models for Question Answering
Vaibhav Adlakha, Parishad BehnamGhader, Xing Han Lu, Nicholas Meade +1
2024-04-18
Artificial Intelligence · Computer Science
Confidence Calibration in Large Language Models
Noam Michael, Daniel BenShushan, Jacob Bien, Don A. Moore
2026-05-26
Computation and Language · Computer Science
Fine-Tuning Language Models for Ethical Ambiguity: A Comparative Study of Alignment with Human Responses
Pranav Senthilkumar, Visshwa Balasubramanian, Prisha Jain, Aneesa Maity +2
2024-10-11
Artificial Intelligence · Computer Science
MoHoBench: Assessing Honesty of Multimodal Large Language Models via Unanswerable Visual Questions
Yanxu Zhu, Shitong Duan, Xiangxu Zhang, Jitao Sang +6
2026-01-14
Computer Vision and Pattern Recognition · Computer Science
Know What You do Not Know: Verbalized Uncertainty Estimation Robustness on Corrupted Images in Vision-Language Models
Mirko Borszukovszki, Ivo Pascal de Jong, Matias Valdenegro-Toro
2025-04-07
Computation and Language · Computer Science
TrustScore: Reference-Free Evaluation of LLM Response Trustworthiness
Danna Zheng, Danyang Liu, Mirella Lapata, Jeff Z. Pan
2024-05-08
Computation and Language · Computer Science
Realistic Conversational Question Answering with Answer Selection based on Calibrated Confidence and Uncertainty Measurement
Soyeong Jeong, Jinheon Baek, Sung Ju Hwang, Jong C. Park
2023-02-13
Computer Vision and Pattern Recognition · Computer Science
VirtueBench: Evaluating Trustworthiness under Uncertainty in Long Video Understanding
Xueqing Yu, Bohan Li, Yan Li, Zhenheng Yang
2026-03-11
Computation and Language · Computer Science
Confidence v.s. Critique: A Decomposition of Self-Correction Capability for LLMs
Zhe Yang, Yichang Zhang, Yudong Wang, Ziyao Xu +2
2024-12-30
Computation and Language · Computer Science
Annotation-Efficient Universal Honesty Alignment
Shiyu Ni, Keping Bi, Jiafeng Guo, Minghao Tang +3
2026-03-05