最好的防御就是进攻:对抗LLM驱动的网络攻击
密码学与安全
2024-10-22 v1 人工智能
摘要
随着大型语言模型(LLM)的不断发展,它们被用于自动化网络攻击的可能性越来越大。凭借侦察、利用和命令执行等能力,LLM可能很快成为自主网络代理不可或缺的一部分,能够发起高度复杂的攻击。在本文中,我们介绍了利用攻击性LLM固有弱点的创新防御策略。通过针对诸如偏见、对输入的信任、记忆限制以及其解决隧道视野问题的方法等弱点,我们开发了误导、延迟或中和这些自主代理的技术。我们在黑盒条件下评估我们的防御,从单次提示-响应场景开始,逐步推进到使用自建CTF机器的真实世界测试。我们的结果显示防御成功率高达90%,证明了将LLM漏洞转化为防御策略以对抗LLM驱动的网络威胁的有效性。
引用
@article{arxiv.2410.15396,
title = {The Best Defense is a Good Offense: Countering LLM-Powered Cyberattacks},
author = {Daniel Ayzenshteyn and Roy Weiss and Yisroel Mirsky},
journal= {arXiv preprint arXiv:2410.15396},
year = {2024}
}