通过仿人机器人评估语音中的语音感知
音频与语音处理
2024-03-18 v1 机器人学
声音
摘要
被背景说话人掩蔽的语音感知(一种常见的日常聆听条件)的潜在机制,通常通过各种冗长的心理物理学测试进行研究。社交主体的存在,例如交互式仿人 NAO 机器人,可能有助于保持参与度和注意力。然而,此类机器人可能具有有限的音质或处理速度。作为将 NAO 用于语音中语音感知心理物理学测试的第一步,我们比较了正常听力年轻成年人在使用标准计算机界面与使用 NAO 机器人来介绍测试并呈现所有相应刺激时的表现。目标句子在存在不同目标掩蔽比的竞争掩蔽语音的情况下,带有颜色和数字关键词呈现。句子由同一说话人产生,但使用语音合成方法引入了目标和掩蔽之间的语音差异。为了评估测试表现,比较了计算机和 NAO 设置之间的语音可懂度和数据收集时长。使用机器人负面态度量表(NARS)和行为线索(反向通道)的量化来评估人机交互。语音可懂度结果显示计算机和 NAO 设置之间具有功能相似性。使用 NAO 时数据收集时长更长。NARS 结果显示参与者在与 NAO 交互之前对机器人持有更积极的态度。使用 NAO 时存在更多积极的反向通道,表明与计算机相比,对机器人的参与度更高。总体而言,本研究展示了 NAO 在呈现语音材料和收集语音中语音感知心理物理学测量方面的潜力。
引用
@article{arxiv.2312.12262,
title = {Evaluating Speech-in-Speech Perception via a Humanoid Robot},
author = {Luke Meyer and Gloria Araiza-Illan and Laura Rachman and Etienne Gaudrain and Deniz Baskent},
journal= {arXiv preprint arXiv:2312.12262},
year = {2024}
}
备注
25 pages (single spaced), 6 figures (at the end of the manuscript), 88 references, under revision with Frontiers