中文

面向多智能体 LLM 的工程化设计:一种协议驱动的方法

软件工程 2025-10-15 v1

摘要

软件开发的日益增长的需求推动了使用大语言模型(LLM)自动化软件工程(SE)任务的研究interest。最近的努力将 LLM 扩展到多智能体系统(MAS),以模拟协作开发工作流程,但这些系统常常因三个核心缺陷而失败:缺乏明确规定、协调错位以及不合适的验证,源于缺乏基础 SE 结构化原则。本文引入软件工程多智能体协议(SEMAP),一种协议层方法论,为多智能体 LLM 实例化三个核心 SE 设计原则:(1)显式行为契约建模、(2)结构化消息传递、(3)生命周期引导的执行与验证,并在 Google 的 Agent-to-Agent(A2A)基础设施上实现。使用多智能体系统失效分类学(MAST)框架进行经验评估,结果表明 SEMAP 在不同 SE 任务中有效降低了失效率。在代码开发中,它将函数级开发的总失效率降低最高可达 69.6%,部署级开发降低最高可达 56.7%。在漏洞检测方面,SEMAP 在 Python 任务中将失效次数降低最高可达 47.4%,在 C/C++ 任务中降低最高可达 28.2%。

关键词

引用

@article{arxiv.2510.12120,
  title  = {Towards Engineering Multi-Agent LLMs: A Protocol-Driven Approach},
  author = {Zhenyu Mao and Jacky Keung and Fengji Zhang and Shuo Liu and Yifei Wang and Jialong Li},
  journal= {arXiv preprint arXiv:2510.12120},
  year   = {2025}
}