主动还是被动:在线社区审核中主动策略的探究
社会与信息网络
2019-07-01 v1 计算机与社会
摘要
Reddit 管理员通常难以预防或遏制此类言论,原因包括:(1)少数人类管理员无法追踪并应对每天数百万的帖子和评论;(2)因管理员决定封禁或隔离仇恨社区而害怕遭到反弹。因此,如我们的背景研究所示,管理行为(社区封禁与隔离)往往是在媒体压力下做出的反应——此前社区内的攻击性言论外溢至现实世界并造成严重后果。在本文中,我们探究 Reddit 上主动审核的可行性——即主动识别那些有风险、可能犯下曾导致其他社区被封禁的违规行为的社区。主动审核策略展现出前景,原因有二:(1)它们有潜力缩小管理员需监控仇恨内容社区的范围;(2)它们为管理员的管理决策与干预提供科学依据。我们的工作表明,社区的用户基础与言论话题在不断演化,且演变为仇恨或危险(即被 Reddit 管理员视为可封禁的)社区往往可提前数月预测。这使得主动审核可行。此外,我们利用可解释机器学习来帮助识别演变为危险社区的最强预测因子,从而为管理员提供关于面临变为危险或仇恨风险的社区特征之洞见。最后,我们大规模地考察了参与仇恨与危险 subreddit 的影响,以及社区封禁与隔离对这些社区成员行为的有效性。
引用
@article{arxiv.1906.11932,
title = {To Act or React: Investigating Proactive Strategies For Online Community Moderation},
author = {Hussam Habib and Maaz Bin Musa and Fareed Zaffar and Rishab Nithyanand},
journal= {arXiv preprint arXiv:1906.11932},
year = {2019}
}