中文

OAgents: 构建有效智能体的实证研究

人工智能 2025-06-24 v2 计算与语言

摘要

近年来,智能体人工智能(Agentic AI)已成为一个日益流行的研究领域。然而,我们认为当前的智能体研究实践缺乏标准化和科学严谨性,使得难以在方法之间进行公平比较。因此,智能体框架中不同的设计选择如何影响有效性仍不清楚,衡量其进展仍然具有挑战性。在这项工作中,我们在GAIA基准和BrowseComp上进行了系统的实证研究,以公平且严谨的方式考察关键智能体组件中流行设计选择的影响。我们发现,缺乏标准评估协议使得以往的工作,即使是开源的工作,也无法复现,随机运行之间存在显著差异。因此,我们引入了一个更稳健的评估协议来稳定比较。我们的研究揭示了哪些组件和设计对于有效的智能体至关重要,而其他组件和设计则是多余的,尽管它们看起来合乎逻辑。基于我们的发现,我们构建并开源了OAgents,这是一个新的基础智能体框架,在开源项目中实现了最先进的性能。OAgents为各种智能体组件提供了模块化设计,促进了智能体人工智能领域的未来研究。

关键词

引用

@article{arxiv.2506.15741,
  title  = {OAgents: An Empirical Study of Building Effective Agents},
  author = {He Zhu and Tianrui Qin and King Zhu and Heyuan Huang and Yeyi Guan and Jinxiang Xia and Yi Yao and Hanhao Li and Ningning Wang and Pai Liu and Tianhao Peng and Xin Gui and Xiaowan Li and Yuhui Liu and Yuchen Eleanor Jiang and Jun Wang and Changwang Zhang and Xiangru Tang and Ge Zhang and Jian Yang and Minghao Liu and Xitong Gao and Jiaheng Liu and Wangchunshu Zhou},
  journal= {arXiv preprint arXiv:2506.15741},
  year   = {2025}
}

备注

28 pages