中文

二元交互场景中多重恰当面部反应生成:是什么、为什么与怎么做?

计算机视觉与模式识别 2023-03-24 v4

摘要

根据刺激-机体-反应(SOR)理论,所有人类行为反应均由情境刺激,人们会处理接收到的刺激并产生恰当反应。这意味着在特定情境下对于给定的输入刺激,人可根据其内部状态和其他情境因素做出不同反应。类似地,在二元交互中,人类使用言语和非言语线索交流,其中听者广泛的非言语反应谱都可能是对特定说话者行为的恰当回应。已有一些工作研究了给定输入自动生成恰当反应的问题。然而,尚无研究尝试在二元交互情境中自动生成多重恰当反应,并使用客观度量评估这些反应的恰当性。本文首次在文献中定义了面部多重恰当反应生成(fMARG)任务,并提出了一组新的客观评估指标来评估生成反应的恰当性。论文随后引入了一个预测、生成和评估多重恰当面部反应的框架。

关键词

引用

@article{arxiv.2302.06514,
  title  = {Multiple Appropriate Facial Reaction Generation in Dyadic Interaction Settings: What, Why and How?},
  author = {Siyang Song and Micol Spitale and Yiming Luo and Batuhan Bal and Hatice Gunes},
  journal= {arXiv preprint arXiv:2302.06514},
  year   = {2023}
}