中文

OAEI-LLM-T:用于理解大语言模型在本体匹配中幻觉的TBox基准数据集

人工智能 2026-01-07 v3 计算与语言 信息检索 机器学习

摘要

幻觉在使用大语言模型(LLM)的下游任务中往往不可避免。为解决针对LLM本体匹配(OM)系统的幻觉问题所面临的重大挑战,我们引入了一个新的基准数据集OAEI-LLM-T。该数据集源自本体对齐评估计划(OAEI)中的七个TBox数据集,捕获了十个不同LLM执行OM任务时的幻觉现象。这些OM特定的幻觉被组织为两个主要类别和六个子类别。我们展示了该数据集在构建OM任务的LLM排行榜以及用于微调用于OM任务的LLM方面的有用性。

关键词

引用

@article{arxiv.2503.21813,
  title  = {OAEI-LLM-T: A TBox Benchmark Dataset for Understanding Large Language Model Hallucinations in Ontology Matching},
  author = {Zhangcheng Qiang and Kerry Taylor and Weiqing Wang and Jing Jiang},
  journal= {arXiv preprint arXiv:2503.21813},
  year   = {2026}
}

备注

14 pages, 4 figures, 4 tables, 2 prompt templates