中文

SWE-Debate:用于软件问题解决的竞争性多智能体辩论

软件工程 2025-08-01 v1 计算与语言 机器学习

摘要

问题解决因大型语言模型 (LLM) 的高级推理能力而取得了显著进展。最近,诸如 SWE-agent 等基于智能体的框架进一步推进了这一进展,通过使智能体能够自主且使用工具来解决复杂的软件工程任务。虽然现有的基于智能体的问题解决方法主要基于智能体的独立探索,但它们常常陷入局部解,难以识别跨越代码库不同部分的问题模式。为此,我们提出了 SWE-Debate,一种鼓励多样化推理路径、实现更一致问题局部化的竞争性多智能体辩论框架。SWE-Debate 首先通过遍历代码依赖图,创建多个作为局部化提案的故障传播轨迹。随后,它组织由三个专门智能体进行的三轮辩论,每个智能体都沿着故障传播轨迹 embody 不同的推理视角。这种结构化的竞争使智能体能够协同收敛到一个一致的修复计划。最后,将这个一致的修复计划集成到基于 MCTS 的代码修改智能体中用于生成补丁。在 SWE-bench 数据集上的实验表明,SWE-Debate 在开源智能体框架方面实现了新的最佳结果,显著优于基线方法。

关键词

引用

@article{arxiv.2507.23348,
  title  = {SWE-Debate: Competitive Multi-Agent Debate for Software Issue Resolution},
  author = {Han Li and Yuling Shi and Shaoxin Lin and Xiaodong Gu and Heng Lian and Xin Wang and Yantao Jia and Tao Huang and Qianxiang Wang},
  journal= {arXiv preprint arXiv:2507.23348},
  year   = {2025}
}

备注

Our code and data are available at https://github.com/YerbaPage/SWE-Debate