IMS 在 PolEval 2018 中的工作:笨重集成依存分析器与 12 条简单规则预测波兰语增强依存
计算与语言
2018-11-08 v1
摘要
本文介绍 IMS 对 PolEval 2018 共享任务的贡献。我们为任务 1 的两个子任务均提交了系统。在子任务(A)(依存分析)中,我们使用了来自 CoNLL 2017 UD 共享任务的集成系统。该系统首先用 CRF 词性/形态标注器对句子预处理,并用神经标注器预测超标注(supertag);随后启用三个不同分析器的多个实例,并通过混合(blending)合并其输出。系统在四个参赛队伍中获第二名。本文展示了系统中哪些组件对其最终性能贡献最大。子任务(B)的目标是预测增强图。我们的方法分两步:用子任务(A)的集成系统分析句子,并应用 12 条简单规则得到最终依存图。这些规则仅为具有“conj”头(连词)的 token 引入额外的增强弧,完全不预测语义关系。系统在三个参赛队伍中排名第一。本文展示了所设计规则的示例,并分析了自动解析树质量与增强图准确率之间的关系。
关键词
引用
@article{arxiv.1811.03036,
title = {IMS at the PolEval 2018: A Bulky Ensemble Depedency Parser meets 12 Simple Rules for Predicting Enhanced Dependencies in Polish},
author = {Agnieszka Falenska and Anders Björkelund and Xiang Yu and Jonas Kuhn},
journal= {arXiv preprint arXiv:1811.03036},
year = {2018}
}