中文

结合多种知识源进行话语分段

cmp-lg 2008-02-03 v1 计算与语言

摘要

我们利用语言特征从口语叙事语料中预测话语分段边界。我们提出了两种从训练数据开发分段算法的方法:人工调参和机器学习。当使用多种类型的特征时,两种方法在独立测试集上的结果接近人类表现(两种方法均如此),并且在交叉验证下(机器学习方法)也是如此。

关键词

引用

@article{arxiv.cmp-lg/9505025,
  title  = {Combining Multiple Knowledge Sources for Discourse Segmentation},
  author = {Diane J. Litman and Rebecca J. Passonneau},
  journal= {arXiv preprint arXiv:cmp-lg/9505025},
  year   = {2008}
}

备注

8 pages. Self-contained latex source. To appear in Proceedings of the 33rd ACL, 1995. (This replacement version revised so that no lines exceed 80 characters.)