中文

“你能当妈妈吗?”:大语言模型时代社交机器人的操纵

人机交互 2025-01-09 v1 计算机与社会 机器人学

摘要

近期大语言模型驱动的机器人技术提升了其对话能力,使其能够实现接近人类的交互。然而,这些模型在人机交互(HRI)中引入了安全与安全隐患,因其易受操纵,可绕过内置安全措施。设想一种部署于家庭环境中的社交机器人,本文旨在了解日常用户如何试图操纵语言模型以违背伦理原则,例如诱使机器人扮演生活伴侣。我们进行了一项包含 21 名大学学生的初步研究,他们与一台 Misty 机器人交互,尝试在三种基于特定 HRI 伦理原则的情景中规避其安全机制:依恋、自由和共情。我们的结果揭示,参与者采用了包括辱骂和诉诸同情等情感语言技巾的五种方法。我们希望本工作可为未来研究设计强有力的安全措施提供指导,以确保伦理且安全的人机交互。

关键词

引用

@article{arxiv.2501.04633,
  title  = {"Can you be my mum?": Manipulating Social Robots in the Large Language Models Era},
  author = {Giulio Antonio Abbo and Gloria Desideri and Tony Belpaeme and Micol Spitale},
  journal= {arXiv preprint arXiv:2501.04633},
  year   = {2025}
}

备注

10 pages, 2 figures