中文

ANDES 在 SemEval-2020 任务 12:用于攻击性语言检测的联合训练 BERT 多语言模型

计算与语言 2020-08-17 v1

摘要

本文描述了我们参与 SemEval-2020 任务 12:多语言攻击性语言检测。我们通过微调多语言 BERT 联合训练了单一模型,以处理所有提议语言中的任务:英语、丹麦语、土耳其语、希腊语和阿拉伯语。我们的单一模型取得了有竞争力的结果,尽管在所有语言中共享相同参数,其性能仍接近顶尖系统。我们还进行了零样本和少样本实验,以分析这些语言之间的迁移性能。我们公开了代码以供进一步研究。

关键词

引用

@article{arxiv.2008.06408,
  title  = {ANDES at SemEval-2020 Task 12: A jointly-trained BERT multilingual model for offensive language detection},
  author = {Juan Manuel Pérez and Aymé Arango and Franco Luque},
  journal= {arXiv preprint arXiv:2008.06408},
  year   = {2020}
}

备注

Github repo: https://github.com/finiteautomata/offenseval2020