中文

诱骗基于 LLM 的 NPC 泄露秘密

密码学与安全 2025-08-28 v1 人工智能

摘要

大语言模型(LLM)正日益被用于为游戏 NPC 生成动态对话。然而,它们的集成引发了新的安全问题。在本研究中,我们考察对抗性提示注入是否能够导致基于 LLM 的 NPC 泄露本应保持保密的隐藏背景秘密。

关键词

引用

@article{arxiv.2508.19288,
  title  = {Tricking LLM-Based NPCs into Spilling Secrets},
  author = {Kyohei Shiomi and Zhuotao Lian and Toru Nakanishi and Teruaki Kitasuka},
  journal= {arXiv preprint arXiv:2508.19288},
  year   = {2025}
}