L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning
人工智能
2026-07-10 v1
摘要
尽管多代理辩论(MAD)框架在一般推理中显示出显著潜力,但它们在高度结构化、知识密集型的法律领域的有效性仍未被充分探索。在本工作中,我们引入了法律多代理辩论(L-MAD)框架,以系统评估法律文本蕴含中不同的辩论结构和聚合方法。通过为多个代理分配不同的专家人格,L-MAD在强单代理基线上提高了高达8%的性能。此外,分析辩论规模揭示了一个明确的权衡:增加代理数量减少了不一致性并提高了准确性,而延长讨论轮次则诱导了有害的过度审议漂移,其中代理强化彼此的错误。最终,我们的发现概述了在高风险的法律推理环境中部署协作多代理系统的实际边界和安全边际。
引用
@article{arxiv.2607.09099,
title = {L-MAD: A Systematic Evaluation of Multi-Agent Debate Structures in Legal Reasoning},
author = {Tan-Minh Nguyen and Hoang-Trung Nguyen and Huu-Dong Nguyen and Dinh-Truong Do and Thi-Hai-Yen Vuong and Le-Minh Nguyen},
journal= {arXiv preprint arXiv:2607.09099},
year = {2026}
}
备注
Outstanding paper in the AI4Law Workshop at ICML 2026