GenAI安全:使用主动测试框架凌驾于机器
密码学与安全
2025-07-30 v1 机器学习
摘要
生成式人工智能(GenAI)模型日益精益化并集成到多样化应用中,引入了新的安全挑战,传统方法难以应对。这项研究探讨了对于缓解GenAI系统受恶意利用风险所必需的主动安全措施的关键性。我们提出了一个包含关键方法、工具和策略的框架,以凌驾于甚至是先进的对抗性攻击,强调确保GenAI创新免受潜在责任的影响。我们通过在SPML Chatbot Prompt Injection数据集上进行测试来实证证明该框架的有效性。本工作突显了从被动转向主动安全实践的重要性,这对于GenAI技术的安全负责任部署至关重要。
引用
@article{arxiv.2505.18172,
title = {GenAI Security: Outsmarting the Bots with a Proactive Testing Framework},
author = {Sunil Kumar Jang Bahadur and Gopala Dhar and Lavi Nigam},
journal= {arXiv preprint arXiv:2505.18172},
year = {2025}
}
备注
IEEE CAI 2025