CoTGuard:基于链条推理触发器的多Agent LLM系统版权保护
计算与语言
2025-05-27 v1 密码学与安全
摘要
随着大语言模型(LLM)发展为具备自主推理与任务执行能力的智能体,多Agent LLM系统已成为解决复杂问题的强大范式。然而,这些系统为内容意外通过Agent间交互与推理被调用带来了新的版权保护挑战。现有保护技术主要聚焦于检测最终输出中的内容,忽略了代理自身内部更丰富且更具揭示性的推理过程。本文引入CoTGuard,一种基于链条推理(Chain-of-Thought, CoT)触发器的版权保护框架。具体而言,我们可以通过在Agent提示中嵌入特定触发查询来激活特定CoT片段,并监控中间推理步骤,以检测未经授权的内容复制。该方法使我们能够在协作式Agent场景中实现对版权侵犯的细粒度、可解释检测。我们在广泛的基准测试上进行大量实验,表明CoTGuard能够以最小干扰任务性能的方式有效揭示内容泄露。我们的发现表明,推理水平的监控为保护LLM基于Agent系统的知识产权提供了有前景的方向。
引用
@article{arxiv.2505.19405,
title = {CoTGuard: Using Chain-of-Thought Triggering for Copyright Protection in Multi-Agent LLM Systems},
author = {Yan Wen and Junfeng Guo and Heng Huang},
journal= {arXiv preprint arXiv:2505.19405},
year = {2025}
}
备注
18 pages, 1 figure