基于生成式智能体的人机助理交互研究平台的设计与评估:十个用户研究的故事
人机交互
2025-11-25 v2
摘要
设计和评估个性化且主动的助理智能体仍具有挑战性,这与人类在循环中进行实验的时间、成本以及伦理顾虑有关。现有的 Human-Computer Interaction(HCI)方法通常需要大量的物理设置和人类参与,引入隐私顾虑并限制可扩展性。模拟环境提供了部分解决方案,但通常受限于基于规则的情景,并且仍高度依赖人类输入来指导交互和解释结果。最近的大语言模型(LLM)进步引入了能够模拟逼真人类行为、推理和社会动态的生成式智能体的可能性。然而,这些智能体在建模人机交互方面的有效性仍鲜有探索。为填补这一空白,我们提出了一个基于生成式智能体的仿真平台,用于模拟人机交互。我们识别出十项关于助理智能体的先前研究,这些研究涵盖了交互设计的不同方面,我们使用仿真平台复制了这些研究。我们的结果表明,使用生成式智能体进行的完全仿真实验可以近似地再现人机交互的关键方面。基于这些仿真,我们能够复制原始研究的核心结论。我们的工作提供了一种可扩展且高性价比的研究助理智能体设计的方法,而无需活体受试者。附加资源和项目材料可在 https://dash-gidea.github.io/ 获取。
引用
@article{arxiv.2505.09938,
title = {Design and Evaluation of Generative Agent-based Platform for Human-Assistant Interaction Research: A Tale of 10 User Studies},
author = {Ziyi Xuan and Yiwen Wu and Xuhai Xu and Vinod Namboodiri and Mooi Choo Chuah and Yu Yang},
journal= {arXiv preprint arXiv:2505.09938},
year = {2025}
}