Tha3aroon 在 NSURL-2019 任务 8 上的工作:阿拉伯语语义问句相似度
计算与语言
2020-01-01 v1 机器学习
摘要
在本文中,我们描述了我们团队在 NSURL 2019 语义文本问句相似度任务上的工作。我们性能最优的系统利用若干创新的数据增强技术来扩充训练数据。随后,它取数据的 ELMo 预训练上下文嵌入并将其输入带自注意力的 ON-LSTM 网络。这产生序列表示向量,用于预测问句对之间的关系。该模型在公开和私有排行榜上分别以 96.499 的 F1 值(与第二名 F1 值相同)和 94.848 的 F1 值(与第一名相差 1.076 个 F1 值)位列第 1 和第 2 名。
引用
@article{arxiv.1912.12514,
title = {Tha3aroon at NSURL-2019 Task 8: Semantic Question Similarity in Arabic},
author = {Ali Fadel and Ibraheem Tuffaha and Mahmoud Al-Ayyoub},
journal= {arXiv preprint arXiv:1912.12514},
year = {2020}
}
备注
8 pages, 8 figures, 4 tables