Hate-Alert@DravidianLangTech-EACL2021:基于Transformer的攻击性语言检测的集成策略
计算与语言
2021-02-22 v1 人工智能
摘要
社交媒体常成为各类攻击性内容的滋生地。对于泰米尔语等低资源语言,由于多语言或特定语言模型性能不佳且缺乏恰当基准数据集,情况更为复杂。基于EACL 2021达罗毗荼语言攻击性语言识别这一共享任务,我们给出了对不同transformer模型的详尽探索,并提供了一种用于集成不同模型的遗传算法技术。我们为每种语言分别训练的集成模型在泰米尔语子任务中获第一,在坎纳达语中获第二,在马拉雅拉姆语中获第一。我们提供了模型与代码。
引用
@article{arxiv.2102.10084,
title = {Hate-Alert@DravidianLangTech-EACL2021: Ensembling strategies for Transformer-based Offensive language Detection},
author = {Debjoy Saha and Naman Paharia and Debajit Chakraborty and Punyajoy Saha and Animesh Mukherjee},
journal= {arXiv preprint arXiv:2102.10084},
year = {2021}
}
备注
6 pages, 1 figure, 3 tables, code available at https://github.com/Debjoy10/Hate-Alert-DravidianLangTech