中文

哪条评论更具毒性?来自 Jigsaw 毒性评论严重程度评测的发现

计算与语言 2022-06-28 v1

摘要

网络仇恨言论的泛滥使得开发能够检测毒性的算法成为必要。过去大多数研究将这种检测视为分类任务,但赋予绝对的毒性标签往往很棘手。因此,少数已有工作将同一任务转化为回归问题。本文展示了不同 transformer 和传统机器学习模型在 Jigsaw 最近发布的毒性严重程度度量数据集上的比较评估。我们进一步通过可解释性分析展示了模型预测存在的问题。

关键词

引用

@article{arxiv.2206.13284,
  title  = {Which one is more toxic? Findings from Jigsaw Rate Severity of Toxic Comments},
  author = {Millon Madhur Das and Punyajoy Saha and Mithun Das},
  journal= {arXiv preprint arXiv:2206.13284},
  year   = {2022}
}