结合多种知识源进行话语分段
cmp-lg
2008-02-03 v1 计算与语言
摘要
我们利用语言特征从口语叙事语料中预测话语分段边界。我们提出了两种从训练数据开发分段算法的方法:人工调参和机器学习。当使用多种类型的特征时,两种方法在独立测试集上的结果接近人类表现(两种方法均如此),并且在交叉验证下(机器学习方法)也是如此。
引用
@article{arxiv.cmp-lg/9505025,
title = {Combining Multiple Knowledge Sources for Discourse Segmentation},
author = {Diane J. Litman and Rebecca J. Passonneau},
journal= {arXiv preprint arXiv:cmp-lg/9505025},
year = {2008}
}
备注
8 pages. Self-contained latex source. To appear in Proceedings of the 33rd ACL, 1995. (This replacement version revised so that no lines exceed 80 characters.)