Transformer与集成方法:阿拉伯语仇恨语音检测的一种解决方案
计算与语言
2025-07-22 v2 人工智能
机器学习
摘要
本文描述了我们参与CERIST NLP Challenge 2022子任务之一——仇恨语音检测共享任务的情况。我们的实验评估了六种Transformer模型及其通过两种集成方法组合的性能。在五折交叉验证场景下,训练集上的最佳结果由基于多数投票的集成方法取得。该方法在测试集上的评估结果为F1-score 0.60与准确率0.86。
引用
@article{arxiv.2303.09823,
title = {Transformers and Ensemble methods: A solution for Hate Speech Detection in Arabic languages},
author = {Angel Felipe Magnossão de Paula and Imene Bensalem and Paolo Rosso and Wajdi Zaghouani},
journal= {arXiv preprint arXiv:2303.09823},
year = {2025}
}
备注
6 pages, 3 tables