哪条评论更具毒性?来自 Jigsaw 毒性评论严重程度评测的发现
计算与语言
2022-06-28 v1
摘要
网络仇恨言论的泛滥使得开发能够检测毒性的算法成为必要。过去大多数研究将这种检测视为分类任务,但赋予绝对的毒性标签往往很棘手。因此,少数已有工作将同一任务转化为回归问题。本文展示了不同 transformer 和传统机器学习模型在 Jigsaw 最近发布的毒性严重程度度量数据集上的比较评估。我们进一步通过可解释性分析展示了模型预测存在的问题。
引用
@article{arxiv.2206.13284,
title = {Which one is more toxic? Findings from Jigsaw Rate Severity of Toxic Comments},
author = {Millon Madhur Das and Punyajoy Saha and Mithun Das},
journal= {arXiv preprint arXiv:2206.13284},
year = {2022}
}