中文

“发生了什么”——一种以人为中心的多模态解释器,用于解释自动驾驶车辆的行为

人机交互 2025-01-14 v2

摘要

公众对自动驾驶汽车的不信任感正在增长。研究强调需要向乘客解释这些车辆的行为,以促进对自主系统的信任。解释器可以通过提高透明度和降低感知风险来增强信任。然而,当前的解决方案往往缺乏以人为中心的多模态解释集成方法。本文介绍了一种新颖的以人为中心的多模态解释器(HMI)系统,该系统利用人类偏好提供视觉、文本和听觉反馈。该系统结合了鸟瞰图(BEV)、地图和文本显示的视觉界面,以及使用微调大型语言模型(LLM)的语音交互。我们的用户研究涉及多样化的参与者,表明HMI系统显著提升了乘客对自动驾驶汽车的信任,平均信任水平提高了8%以上,在普通环境中信任度提升高达30%。这些结果凸显了HMI系统通过提供清晰、实时且上下文敏感的车辆行为解释,在提升自动驾驶汽车接受度和可靠性方面的潜力。

关键词

引用

@article{arxiv.2501.05322,
  title  = {"What's Happening"- A Human-centered Multimodal Interpreter Explaining the Actions of Autonomous Vehicles},
  author = {Xuewen Luo and Fan Ding and Ruiqi Chen and Rishikesh Panda and Junnyong Loo and Shuyun Zhang},
  journal= {arXiv preprint arXiv:2501.05322},
  year   = {2025}
}

备注

This paper has been accepted for presentation at WACV Workshop HAVI 2025