中文

揭露付费意见操纵水军

机器学习 2021-09-29 v1 计算与语言 信息检索 社会与信息网络

摘要

近来,网络论坛已被意见操纵水军入侵。一些水军受自身信念驱动试图影响其他用户,而在其他情况下他们可能是有组织的且受雇的,例如由政党或公关机构雇用并给出具体撰写指令。使用机器学习自动发现付费水军是一项困难任务,因为没有足够的训练数据来训练分类器;但获取一些测试数据是可能的,因为这些水军有时会被抓获并广泛曝光。在本文中,我们通过假设一个被多个不同人称为水军的用户很可能是水军,而从未被称为水军的用户不太可能是水军,来解决训练数据问题。我们比较了(i)付费水军、(ii)“被提及的”水军与(iii)非水军的用户画像,并进一步表明,训练用于区分(ii)与(iii)的分类器在区分(i)与(iii)时也表现相当好。

关键词

引用

@article{arxiv.2109.13726,
  title  = {Exposing Paid Opinion Manipulation Trolls},
  author = {Todor Mihaylov and Ivan Koychev and Georgi Georgiev and Preslav Nakov},
  journal= {arXiv preprint arXiv:2109.13726},
  year   = {2021}
}

备注

opinion manipulation trolls, trolls, opinion manipulation, community forums, news media