AI蠕虫来了:释放针对生成式AI应用的零点击蠕虫
密码学与安全
2025-01-31 v2
摘要
在本文中,我们表明,当生成式AI应用之间的通信依赖于基于RAG的推理时,攻击者可以引发一种类似计算机蠕虫的连锁反应,我们称之为Morris-II。这是通过构造一个对抗性自复制提示来实现的,该提示在生态系统内触发一系列间接提示注入,迫使每个受影响的应用执行恶意操作并破坏其他应用的RAG。我们评估了该蠕虫在生成式AI电子邮件助手生态系统内创建机密用户数据提取链的性能,并分析了上下文大小、对抗性自复制提示、所用嵌入算法的类型和大小以及传播跳数如何影响蠕虫的性能。最后,我们介绍了Virtual Donkey,这是一种旨在以最小延迟、高精度和低误报率检测并阻止Morris-II传播的防护措施。我们评估了该防护措施的性能,并表明其真阳性率达到完美的1.0,误报率为0.015,并且对分布外蠕虫(包括未见过的越狱命令、不同的电子邮件数据集和各种蠕虫用例)具有鲁棒性。
引用
@article{arxiv.2403.02817,
title = {Here Comes The AI Worm: Unleashing Zero-click Worms that Target GenAI-Powered Applications},
author = {Stav Cohen and Ron Bitton and Ben Nassi},
journal= {arXiv preprint arXiv:2403.02817},
year = {2025}
}
备注
Website: https://sites.google.com/view/compromptmized