迈向智能体、人类与环境的统一对齐
人工智能
2024-02-15 v2 计算与语言
机器学习
摘要
基础模型的快速进步推动了自主智能体的繁荣,这些智能体利用基础模型的通用能力进行推理、决策和环境交互。然而,当智能体在复杂、真实的环境中运行时,其有效性仍然受限。在这项工作中,我们引入了智能体统一对齐 () 的原则,主张同时将智能体与人类意图、环境动态以及自我约束(如货币预算限制)进行对齐。从 的角度出发,我们回顾了当前的智能体研究,并强调了现有智能体基准和方法候选者中被忽视的因素。我们还通过为 WebShop 引入真实特征进行了概念验证研究,包括展示意图的用户画像、针对复杂环境动态的个性化重排序,以及反映自我约束的运行时成本统计。随后,我们遵循 原则提出了智能体的初步设计,并在改造后的 WebShop 中将其性能与几个候选基线进行了基准测试。广泛的实验结果进一步证明了 原则的重要性。我们的研究为具有改进的通用问题解决能力的自主智能体研究的下一步指明了方向。
引用
@article{arxiv.2402.07744,
title = {Towards Unified Alignment Between Agents, Humans, and Environment},
author = {Zonghan Yang and An Liu and Zijun Liu and Kaiming Liu and Fangzhou Xiong and Yile Wang and Zeyuan Yang and Qingyuan Hu and Xinrui Chen and Zhenhe Zhang and Fuwen Luo and Zhicheng Guo and Peng Li and Yang Liu},
journal= {arXiv preprint arXiv:2402.07744},
year = {2024}
}
备注
Project webpage: https://agent-force.github.io/unified-alignment-for-agents.html