捷克语副参数框架的自动抽取
计算与语言
2007-05-23 v1
摘要
我们提出了若干新型机器学习技术用于识别捷克语动词的副参数信息。我们比较了应用于该问题的三种不同统计技术。我们展示了学习算法如何从捷克布拉格依存树库中发现先前未知的副参数框架。该算法随后可用于将捷克树库中动词的依词标记为要么是论元,要么是附着词。通过 our 技术,我们能够在未解析文本上实现88%的精确率。
引用
@article{arxiv.cs/0009003,
title = {Automatic Extraction of Subcategorization Frames for Czech},
author = {Anoop Sarkar and Daniel Zeman},
journal= {arXiv preprint arXiv:cs/0009003},
year = {2007}
}
备注
7 pages. Another version under the name "Learning Verb Subcategorization from Corpora: Counting Frame Subsets", authors: Zeman, Sarkar, in proceedings of LREC 2000, Athens, Greece