中文

REFLEX:基于判决锚定风格控制的自我完善可解释事实核查

计算与语言 2026-04-21 v3

摘要

社交媒体上假新闻的盛行迫切需要自动化事实核查系统提供准确的判决并配以忠实的解释。然而,现有基于大语言模型(LLM)的方法忽略了LLM生成解释中潜在的误导性新闻风格,导致生成的理由充当误导性信息。它们高度依赖外部知识源,引入幻觉甚至高延迟,削弱了可靠性和响应速度,这些都是实际场景中至关重要的。为此,我们提出了REason-guided Fact-checking with Latent EXplanations(REFLEX),一种基于判决锚定风格控制的自我完善范式。REFLEX利用背板模型与其微调变体之间的自我不一致信心信号构建驾驶向量,自然地将事实与风格分离。实验表明,在仅使用465个自我完善样本的情况下,REFLEX在Llama系列模型上实现了在事实核查领域的领先性能。此外,鉴于其可迁移性,REFLEX在野外数据上可实现最高7.54%的提升。我们的结果进一步表明,该方法有效缓解了忠实性幻觉,从而引导模型在可解释事实核查方面比以前的工作获得更准确的判决。

关键词

引用

@article{arxiv.2511.20233,
  title  = {REFLEX: Self-Refining Explainable Fact-Checking via Verdict-Anchored Style Control},
  author = {Chuyi Kong and Gao Wei and Jing Ma and Hongzhan Lin and Yuxi Sun},
  journal= {arXiv preprint arXiv:2511.20233},
  year   = {2026}
}

备注

29 pages