基于聆听的游戏化说话人比对
声音
2022-05-11 v1 音频与语音处理
摘要
我们研究在类游戏环境中通过聆听进行说话人比对,假设该任务能使 naive 听众更有动力。我们在 x-vector 说话人识别系统的帮助下从 VoxCeleb 中选取相同的 30 个试验,呈现给通过 Amazon Mechanical Turk 招募的共 150 名众包工作者。他们被分为每组 50 人的队列,分别使用三种备选界面设计之一:(i) 传统(非游戏化)设计;(ii) 带决策反馈、积分、游戏等级指示以及界面自定义可能性的游戏化设计;(iii) 另一种附加错误答案最多消耗 5 个“生命”限制的游戏化设计。我们分析了这些界面设计对听众错误率(漏报与虚警)、概率校准、退出时间以及调查问卷的影响。结果表明从 (i) 到 (ii) 和 (iii) 性能有所提升,尤其在平衡两类检测错误方面。
引用
@article{arxiv.2205.04923,
title = {Gamified Speaker Comparison by Listening},
author = {Sandip Ghimire and Tomi Kinnunen and Rosa Gonzalez Hautamäki},
journal= {arXiv preprint arXiv:2205.04923},
year = {2022}
}
备注
Accepted to Odyssey 2022 The Speaker and Language Recognition Workshop