揭露付费意见操纵水军
机器学习
2021-09-29 v1 计算与语言
信息检索
社会与信息网络
摘要
近来,网络论坛已被意见操纵水军入侵。一些水军受自身信念驱动试图影响其他用户,而在其他情况下他们可能是有组织的且受雇的,例如由政党或公关机构雇用并给出具体撰写指令。使用机器学习自动发现付费水军是一项困难任务,因为没有足够的训练数据来训练分类器;但获取一些测试数据是可能的,因为这些水军有时会被抓获并广泛曝光。在本文中,我们通过假设一个被多个不同人称为水军的用户很可能是水军,而从未被称为水军的用户不太可能是水军,来解决训练数据问题。我们比较了(i)付费水军、(ii)“被提及的”水军与(iii)非水军的用户画像,并进一步表明,训练用于区分(ii)与(iii)的分类器在区分(i)与(iii)时也表现相当好。
引用
@article{arxiv.2109.13726,
title = {Exposing Paid Opinion Manipulation Trolls},
author = {Todor Mihaylov and Ivan Koychev and Georgi Georgiev and Preslav Nakov},
journal= {arXiv preprint arXiv:2109.13726},
year = {2021}
}
备注
opinion manipulation trolls, trolls, opinion manipulation, community forums, news media