中文

隐藏于明文:RAG 中社交网络间接提示注入基准测试

密码学与安全 2026-01-22 v2 人机交互

摘要

检索增强生成(RAG)系统越来越重视将其响应建立在网络上发现的用户生成内容之上,这既放大了其效用,也扩大了其攻击面。最值得注意的是,间接提示注入和检索中毒攻击了在摄取流程中存活的网络原生载体,这非常令人担忧。我们以离散数据包的形式提供了 OpenRAG-Soc,这是一个紧凑、可复现的基准测试与测试套件,用于在这些威胁下评估面向网络的 RAG。该套件将社交语料库与可互换的稀疏和密集检索器以及可部署的缓解措施(HTML/Markdown 清理、Unicode 规范化和归因门控回答)相结合。它标准化了从摄取到生成的端到端评估,并在回答时报告其中一个响应的攻击时间、稀疏和密集检索器中的排名变化、效用和延迟,从而允许在不同载体和防御之间进行公平比较。OpenRAG-Soc 面向需要快速、真实的测试来跟踪风险并强化部署的从业者。

关键词

引用

@article{arxiv.2601.10923,
  title  = {Hidden-in-Plain-Text: A Benchmark for Social-Web Indirect Prompt Injection in RAG},
  author = {Haoze Guo and Ziqi Wei},
  journal= {arXiv preprint arXiv:2601.10923},
  year   = {2026}
}

备注

WWW 2026