中文

用于检测机器人的波斯语 Instagram 用户行为建模

社会与信息网络 2020-08-11 v1

摘要

机器人是社交媒体中由计算机程序控制的用户账户。与许多其他事物类似,它们被用于良性和恶意目的。其一种恶意用例是在网络中传播错误信息或有偏数据。已有大量基于社交媒体数据的研究,而其结果的有效性极易受到机器人传播的有害数据的威胁。因此,需要有效的方法和工具来检测机器人并清除其传播的误导数据。本研究提出一种检测 Instagram 机器人的方法。目前没有包含 Instagram 机器人与真实账户样本的数据集,故本研究首先顾及普适性收集此类数据集,每组各含 1000 个数据点。主要方法为监督式机器学习,且相较于深度神经网络更偏好经典模型。最终模型经多种方法评估,始于 10 折交叉验证。随后进行分类置信度研究,继而开展特征重要性分析及特征相对于模型计算的目标概率的行为分析。最后,设计实验以衡量模型在运行环境中的有效性。最终强烈得出结论:该模型在所有评估实验中表现极佳。

关键词

引用

@article{arxiv.2008.03951,
  title  = {Behavioral Modeling of Persian Instagram Users to detect Bots},
  author = {Muhammad Bazm and Masoud Asadpour},
  journal= {arXiv preprint arXiv:2008.03951},
  year   = {2020}
}