ANDES 在 SemEval-2020 任务 12:用于攻击性语言检测的联合训练 BERT 多语言模型
计算与语言
2020-08-17 v1
摘要
本文描述了我们参与 SemEval-2020 任务 12:多语言攻击性语言检测。我们通过微调多语言 BERT 联合训练了单一模型,以处理所有提议语言中的任务:英语、丹麦语、土耳其语、希腊语和阿拉伯语。我们的单一模型取得了有竞争力的结果,尽管在所有语言中共享相同参数,其性能仍接近顶尖系统。我们还进行了零样本和少样本实验,以分析这些语言之间的迁移性能。我们公开了代码以供进一步研究。
引用
@article{arxiv.2008.06408,
title = {ANDES at SemEval-2020 Task 12: A jointly-trained BERT multilingual model for offensive language detection},
author = {Juan Manuel Pérez and Aymé Arango and Franco Luque},
journal= {arXiv preprint arXiv:2008.06408},
year = {2020}
}
备注
Github repo: https://github.com/finiteautomata/offenseval2020