中文

生成式 AI 在信任与安全领域如何赋能攻击者与防御者

人机交互 2026-04-24 v2 密码学与安全 计算机与社会

摘要

生成式 AI (GenAI) 作为一种强大的技术,正准备重塑信任与安全领域。尽管攻击者的滥用是日益增长的担忧,但其防御能力仍未得到充分探索。本文通过对 43 名来自五个领域的信任与安全专家进行的定性研究来阐述这些影响:儿童安全、选举完整性、仇恨与骚扰、诈骗以及暴力极端主义。我们的发现表明,GenAI 同时赋能了攻击者和防御者。GenAI 大幅提高了攻击的规模和速度,降低了创建有害内容(包括复杂宣传和深度伪造)的门槛。相反,防御者设想利用 GenAI 在规模上检测和缓解有害内容、开展调查、部署具有说服力的反叙事、改善版主的福祉以及提供用户支持。本工作提供了理解 GenAI 对信任与安全影响的战略框架,并为其负责任的使用指明了在创建更安全的在线环境方面的道路。

关键词

引用

@article{arxiv.2601.06033,
  title  = {How Generative AI Empowers Attackers and Defenders Across the Trust & Safety Landscape},
  author = {Patrick Gage Kelley and Steven Rousso-Schindler and Renee Shelby and Kurt Thomas and Allison Woodruff},
  journal= {arXiv preprint arXiv:2601.06033},
  year   = {2026}
}

备注

21 pages, 4 tables, 1 figure