MedFact:基于证据的大规模中文医学事实核查数据集
计算与语言
2025-09-23 v1
摘要
医学事实核查日益重要,因为越来越多的人在线寻求医疗信息。然而,现有数据集主要关注人类生成内容,对大语言模型(LLM)生成内容的核查相对未被探索。为填补这一空白,我们引入MedFact,即基于证据的首个中文医学事实核查数据集,包含1,321个问题和7,409个主张,镜像现实世界医疗场景的复杂性。我们在准则学习(ICL)和微调设置中进行了全面实验,展示了当前LLM在该任务上的能力和挑战,并深入分析了错误,指出了未来研究的关键方向。我们的数据集已公开发布。
引用
@article{arxiv.2509.17436,
title = {MedFact: A Large-scale Chinese Dataset for Evidence-based Medical Fact-checking of LLM Responses},
author = {Tong Chen and Zimu Wang and Yiyi Miao and Haoran Luo and Yuanfei Sun and Wei Wang and Zhengyong Jiang and Procheta Sen and Jionglong Su},
journal= {arXiv preprint arXiv:2509.17436},
year = {2025}
}
备注
Accepted at EMNLP 2025. Camera-ready version