中文

通过合作博弈学习恢复多跳问答的推理链

计算与语言 2020-04-07 v1

摘要

我们提出了从弱监督信号(即问答对)中学习恢复推理链这一新问题。我们提出了一种合作博弈方法来处理该问题,其中证据段落的选择方式以及所选段落的连接方式由两个不同的模型负责,这两个模型相互协作,从大量候选(来自远程监督)中选出最可信的链。为进行评估,我们基于两个多跳问答数据集 HotpotQA 和 MedHop 构建了基准,并对后者手工标注了推理链。实验结果证明了我们所提方法的有效性。

关键词

引用

@article{arxiv.2004.02393,
  title  = {Learning to Recover Reasoning Chains for Multi-Hop Question Answering via Cooperative Games},
  author = {Yufei Feng and Mo Yu and Wenhan Xiong and Xiaoxiao Guo and Junjie Huang and Shiyu Chang and Murray Campbell and Michael Greenspan and Xiaodan Zhu},
  journal= {arXiv preprint arXiv:2004.02393},
  year   = {2020}
}