BanglaNLP 在 BLP-2023 任务 1 上的工作:孟加拉语煽动暴力文本检测中不同 Transformer 模型的基准评测
计算与语言
2023-10-18 v1
摘要
本文介绍了我们在解决孟加拉语煽动暴力文本检测共享任务时所开发的系统。我们解释了为使模型学习而采用的传统方法与近期方法。我们提出的系统有助于分类给定文本是否包含任何威胁。我们研究了在可用数据集有限时数据增强的影响。我们的定量结果表明,与其他基于 transformer 的架构相比,微调 multilingual-e5-base 模型在我们的任务中表现最佳。我们在测试集上获得了 68.11% 的宏 F1,且在该共享任务中的排行榜排名为第 23 名。
引用
@article{arxiv.2310.10781,
title = {BanglaNLP at BLP-2023 Task 1: Benchmarking different Transformer Models for Violence Inciting Text Detection in Bengali},
author = {Saumajit Saha and Albert Nanda},
journal= {arXiv preprint arXiv:2310.10781},
year = {2023}
}
备注
5 pages, 2 figures, workshop