Mavericks 团队在 BLP-2023 任务 1 中的工作:基于集成语言模型的方法用于煽动暴力文本检测
计算与语言
2023-12-01 v1
摘要
本文介绍了我们在首届孟加拉语处理研讨会(First Workshop on Bangla Language Processing)中煽动暴力文本检测共享任务上的工作。社交媒体加速了社会中仇恨与煽动暴力言论的传播。亟需建立高效机制以检测并遏制此类文本的传播。由于研究稀疏且数据较少,在低资源环境下检测煽动暴力文本的问题更加严峻。该共享任务提供的数据由孟加拉语文本组成,其中每个样本被分类为基于煽动暴力文本类型定义的三个类别之一。我们尝试并评估了多个基于 BERT 的模型,随后将这些模型集成作为最终提交。我们的提交在共享任务最终排行榜中排名第 10,宏 F1 得分为 0.737。
引用
@article{arxiv.2311.18778,
title = {Mavericks at BLP-2023 Task 1: Ensemble-based Approach Using Language Models for Violence Inciting Text Detection},
author = {Saurabh Page and Sudeep Mangalvedhekar and Kshitij Deshpande and Tanmay Chavan and Sheetal Sonawane},
journal= {arXiv preprint arXiv:2311.18778},
year = {2023}
}
备注
6 pages, 1 figure, accepted at the BLP Workshop, EMNLP 2023