中文

音频到身体动态

音频与语音处理 2020-05-11 v1 计算机视觉与模式识别 声音

摘要

我们提出了一种方法,其输入为小提琴或钢琴演奏的音频,输出为骨架预测视频,并进一步用于驱动虚拟角色动画。其关键思想是从音频出发,创建一个虚拟角色的动画,使其手部运动类似于钢琴家或小提琴家的动作。旨在实现完全细致正确的手臂与手指运动是一个目标,然而,身体运动是否可从音乐中预测尚不清楚。在本文中,我们展示了首个表明自然身体动态至少可被预测的结果。我们构建了一个 LSTM 网络,并在上传至互联网的小提琴与钢琴演奏视频上进行训练。预测的点被应用于绑定骨骼的虚拟角色以创建动画。

关键词

引用

@article{arxiv.1712.09382,
  title  = {Audio to Body Dynamics},
  author = {Eli Shlizerman and Lucio M. Dery and Hayden Schoen and Ira Kemelmacher-Shlizerman},
  journal= {arXiv preprint arXiv:1712.09382},
  year   = {2020}
}

备注

Link with videos https://arviolin.github.io/AudioBodyDynamics/