Ubuntu Dialog Corpus 对话的改进深度学习基线
计算与语言
2015-11-04 v2
摘要
本文展示了我们在 Ubuntu Dialog Corpus(最大的公开可用多轮对话语料库)上进行下一话语排序的实验结果。首先,我们使用先前报道模型的内部实现,利用相同数据进行独立评估。其次,我们在该数据集上评估了各种 LSTM、Bi-LSTM 和 CNN 的性能。第三,我们通过平均多个模型的预测来创建集成。该集成进一步提升了性能,并在这个数据集的下一话语排序上达到了最先进结果。最后,我们讨论了使用该语料库的未来计划。
引用
@article{arxiv.1510.03753,
title = {Improved Deep Learning Baselines for Ubuntu Corpus Dialogs},
author = {Rudolf Kadlec and Martin Schmid and Jan Kleindienst},
journal= {arXiv preprint arXiv:1510.03753},
year = {2015}
}
备注
Accepted to Machine Learning for SLU & Interaction NIPS 2015 Workshop