“你能当妈妈吗?”:大语言模型时代社交机器人的操纵
人机交互
2025-01-09 v1 计算机与社会
机器人学
摘要
近期大语言模型驱动的机器人技术提升了其对话能力,使其能够实现接近人类的交互。然而,这些模型在人机交互(HRI)中引入了安全与安全隐患,因其易受操纵,可绕过内置安全措施。设想一种部署于家庭环境中的社交机器人,本文旨在了解日常用户如何试图操纵语言模型以违背伦理原则,例如诱使机器人扮演生活伴侣。我们进行了一项包含 21 名大学学生的初步研究,他们与一台 Misty 机器人交互,尝试在三种基于特定 HRI 伦理原则的情景中规避其安全机制:依恋、自由和共情。我们的结果揭示,参与者采用了包括辱骂和诉诸同情等情感语言技巾的五种方法。我们希望本工作可为未来研究设计强有力的安全措施提供指导,以确保伦理且安全的人机交互。
引用
@article{arxiv.2501.04633,
title = {"Can you be my mum?": Manipulating Social Robots in the Large Language Models Era},
author = {Giulio Antonio Abbo and Gloria Desideri and Tony Belpaeme and Micol Spitale},
journal= {arXiv preprint arXiv:2501.04633},
year = {2025}
}
备注
10 pages, 2 figures