噢天呐!还是嗯哼?一种基于ASR转写文本的听众感知反馈信号预测器
计算与语言
2023-04-11 v1 声音
音频与语音处理
摘要
本文介绍我们近期在对话中反馈信号建模方面的最新研究。受主动反馈理论启发,我们旨在开发一个系统,作为主动听众通过插入反馈信号(如延续语和评估语)来影响说话者。我们的模型不仅考虑词汇与声学线索,还引入简单而新颖的思路,即使用听众嵌入来模拟不同的反馈行为。我们在Switchboard基准数据集上的实验结果表明,在此任务中声学线索比词汇线索更重要,且它们与听众嵌入的结合在人工转写文本和自动生成转写文本上均表现最佳。
引用
@article{arxiv.2304.04478,
title = {Oh, Jeez! or Uh-huh? A Listener-aware Backchannel Predictor on ASR Transcriptions},
author = {Daniel Ortega and Chia-Yu Li and Ngoc Thang Vu},
journal= {arXiv preprint arXiv:2304.04478},
year = {2023}
}
备注
Published in ICASSP 2020