面向篇章解析与机器理解的大规模多方对话数据集标注方案
计算与语言
2019-11-12 v1
摘要
在本文中,我们提出用于篇章解析与机器理解的大规模多方聊天对话标注方案。该项目的主要目标是帮助理解多方对话。我们的数据集基于 Ubuntu Chat Corpus。对于每个多方对话,我们标注其篇章结构与问答对。据我们所知,这是首个用于多方对话篇章解析的大规模语料库,并且我们首次提出了多方对话机器阅读理解任务。
引用
@article{arxiv.1911.03514,
title = {An Annotation Scheme of A Large-scale Multi-party Dialogues Dataset for Discourse Parsing and Machine Comprehension},
author = {Jiaqi Li and Ming Liu and Bing Qin and Zihao Zheng and Ting Liu},
journal= {arXiv preprint arXiv:1911.03514},
year = {2019}
}