中文

好父母全能方可 —— 多智能体 LLM 幻觉缓解

密码学与安全 2024-10-28 v3 计算与语言

摘要

本研究探讨了大型语言模型(LLM)代理检测和纠正 AI 生成内容中幻觉的能力。一个主要代理被任务创建关于虚构丹麦艺术家 Flipfloppidy 的博客,然后由另一个代理审查其事实不准确之处。大多数 LLM 会幻觉地假设该艺术家的存在。在 4900 次测试运行中,涉及各种主要代理和审查代理的组合后,像 Llama3-70b 和 GPT-4 变体这类高级 AI 模型在识别幻觉方面几乎完美,并在反馈后成功修正输出 85% 至 100% 的案例。这些发现凸显了高级 AI 模型显著提升生成内容准确性和可靠性的潜力,为改进 AI 工作流程编排提供了有前景的方案。

关键词

引用

@article{arxiv.2410.14262,
  title  = {Good Parenting is all you need -- Multi-agentic LLM Hallucination Mitigation},
  author = {Ted Kwartler and Matthew Berman and Alan Aqrawi},
  journal= {arXiv preprint arXiv:2410.14262},
  year   = {2024}
}