English

SJ_AJ@DravidianLangTech-EACL2021: Task-Adaptive Pre-Training of Multilingual BERT models for Offensive Language Identification

Computation and Language 2021-03-15 v2

Abstract

In this paper we present our submission for the EACL 2021-Shared Task on Offensive Language Identification in Dravidian languages. Our final system is an ensemble of mBERT and XLM-RoBERTa models which leverage task-adaptive pre-training of multilingual BERT models with a masked language modeling objective. Our system was ranked 1st for Kannada, 2nd for Malayalam and 3rd for Tamil.

Keywords

Cite

@article{arxiv.2102.01051,
  title  = {SJ_AJ@DravidianLangTech-EACL2021: Task-Adaptive Pre-Training of Multilingual BERT models for Offensive Language Identification},
  author = {Sai Muralidhar Jayanthi and Akshat Gupta},
  journal= {arXiv preprint arXiv:2102.01051},
  year   = {2021}
}
R2 v1 2026-06-23T22:44:10.521Z