中文

理解钓鱼者模仿统一资源定位符以实施钓鱼攻击的策略:一种机器学习方法

密码学与安全 2020-07-02 v1

摘要

钓鱼是一种社会工程学攻击,意图窃取用户数据(包括登录凭据与信用卡号),导致组织与个人的财务损失。当攻击者假扮可信实体,诱使受害者在邮件或短信中点击链接或附件时发生。钓鱼常通过邮件或社交网络短信发起。既往研究表明,仅通过查看 URL 即可识别钓鱼攻击。识别钓鱼者用于模仿钓鱼 URL 的技术则颇具挑战。目前,我们对网络罪犯如何试图模仿与合法 URL 外观质感一致的 URL 以诱人点击知之有限。因此,本文研究钓鱼 URL(统一资源定位符)的特征选择,旨在探索钓鱼者用以明显骗人点击链接的模仿策略。我们在钓鱼数据集上采用信息增益(IG)与卡方特征选择方法及机器学习(ML)。数据集含从 2015 年 1 月至 5 月及 2017 年 5 月至 6 月下载的网页中提取的 5000 个钓鱼与另 5000 个合法 URL 的共 48 项特征。结果显示钓鱼者使用了 10 种模仿 URL 以操纵人点击链接的技术。识别这些钓鱼 URL 操纵技术必有助于教育个人与组织并使其免遭钓鱼攻击。此外,本研究结果亦将有助于开发反钓鱼工具、框架或浏览器插件以预防钓鱼。

关键词

引用

@article{arxiv.2007.00489,
  title  = {Understanding phishers' strategies of mimicking uniform resource locators to leverage phishing attacks: A machine learning approach},
  author = {J. Samantha Tharani and Nalin Asanka Gamagedara Arachchilage},
  journal= {arXiv preprint arXiv:2007.00489},
  year   = {2020}
}

备注

15