中文

该患者患何疾病?来自医学考试的大规模开放域问答数据集

计算与语言 2020-09-29 v1 人工智能

摘要

开放域问答(OpenQA)任务近来受到自然语言处理(NLP)社区越来越多的关注。在这项工作中,我们提出了首个用于解决医学问题的自由形式多选OpenQA数据集MedQA,其收集自专业医学委员会考试。它涵盖三种语言:英语、简体中文和繁体中文,分别包含12,723、34,251和14,123道问题。我们实现了基于规则和流行神经方法,依次结合文档检索器和机器理解模型。通过实验,我们发现即使当前最佳方法在英语、繁体中文和简体中文问题上的测试准确率也只能分别达到36.7%、42.0%和70.1%。我们期望MedQA对现有OpenQA系统提出巨大挑战,并希望它能作为一个平台,在未来促进NLP社区开发出更强大的OpenQA模型。

关键词

引用

@article{arxiv.2009.13081,
  title  = {What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams},
  author = {Di Jin and Eileen Pan and Nassim Oufattole and Wei-Hung Weng and Hanyi Fang and Peter Szolovits},
  journal= {arXiv preprint arXiv:2009.13081},
  year   = {2020}
}

备注

Submitted to AAAI 2021