中文

HausaNLP 在 SemEval-2025 Task 11 赛道中的表现:哈萨语文本情感检测

计算与语言 2025-06-24 v2

摘要

本文介绍了我们针对 SemEval Track A 中哈萨语(Hausa)多标签情感检测任务的方法。我们对 AfriBERTa——这一基于转换器预训练于非洲语言的模型——进行微调,以将哈萨语文本分类为六种情感:愤怒、厌恶、恐惧、喜悦、悲伤和惊讶。我们的 methodology 包括数据预处理、分词以及使用 Hugging Face Trainer API 进行模型微调。该系统在验证集上取得了 74.00% 的准确率,F1 分数为 73.50%,表明转换器模型在低资源语言情感检测方面具有有效性。

关键词

引用

@article{arxiv.2506.16388,
  title  = {HausaNLP at SemEval-2025 Task 11: Hausa Text Emotion Detection},
  author = {Sani Abdullahi Sani and Salim Abubakar and Falalu Ibrahim Lawan and Abdulhamid Abubakar and Maryam Bala},
  journal= {arXiv preprint arXiv:2506.16388},
  year   = {2025}
}