重新审视依存句法分析器的三训练
计算与语言
2023-10-18 v1
摘要
我们在依存句法分析任务中比较了两种正交的半监督学习技术,即三训练 (tri-training) 与预训练词嵌入。我们探索了特定语言 FastText 和 ELMo 嵌入以及多语言 BERT 嵌入。我们聚焦于低资源场景,因为半监督学习可望在此产生最大影响。基于树库规模和可用 ELMo 模型,我们选择了匈牙利语、维吾尔语(mBERT 的零样本语言)和越南语。此外,我们纳入了模拟低资源设定下的英语。我们发现预训练词嵌入比三训练更有效地利用未标注数据,但这两种方法可以成功结合。
引用
@article{arxiv.2109.08122,
title = {Revisiting Tri-training of Dependency Parsers},
author = {Joachim Wagner and Jennifer Foster},
journal= {arXiv preprint arXiv:2109.08122},
year = {2023}
}
备注
17 pages, 1 figure, to be published at EMNLP 2021