中文

LLM 信任与安全以及LLM在信任与安全领域的应用

人工智能 2025-07-01 v2

摘要

近年来,大型语言模型(LLM)因其在自然语言处理任务中卓越的能力而受到广泛关注。然而,其广泛采纳引发了关于信任与安全的关切。本系统综述调查了LLM信任与安全研究的当前格局,特别关注LLM在信任与安全领域本身的新兴应用。我们深入探讨了在保持信任与安全至关重要的领域中运用LLM的复杂性,提供了对这一新兴趋势的综合视角。通过综合各种研究发现,我们识别出关键挑战和潜在解决方案,旨在帮助寻求理解LLM与信任与安全之间错综相互作用的研究者和实践者。本综述提供了在信任与安全领域使用LLM的最佳实践见解,探索了诸如提示注入和越狱攻击等新兴风险。最终,本研究深化了对如何有效且负责任地利用LLM来增强数字领域信任与安全的理解。

关键词

引用

@article{arxiv.2412.02113,
  title  = {Trust & Safety of LLMs and LLMs in Trust & Safety},
  author = {Doohee You and Dan Chon},
  journal= {arXiv preprint arXiv:2412.02113},
  year   = {2025}
}

备注

11 pages