中文

基于 Transformer 模型的跨语言仇恨言论检测

计算与语言 2021-11-02 v1

摘要

跨语言设定下的仇恨言论检测是所有中大型在线平台都极为关注的一个重要领域。未能在全球范围内妥善解决此问题,随着时间的推移已导致道德上存疑的现实事件、人员死亡以及仇恨本身的延续。本文展示了经过微调的改进多语言 Transformer 模型(mBERT、XLM-RoBERTa)在这一关键社会数据科学任务上的能力,包括从英语到法语的跨语言训练、反向训练以及每种语言各自的训练,并包含关于迭代改进与对比错误分析的章节。

关键词

引用

@article{arxiv.2111.00981,
  title  = {Cross-lingual Hate Speech Detection using Transformer Models},
  author = {Teodor Tiţa and Arkaitz Zubiaga},
  journal= {arXiv preprint arXiv:2111.00981},
  year   = {2021}
}

备注

7 pages