中文

塑造我的动作:文本驱动的体型感知人体动作合成

计算机视觉与模式识别 2025-04-07 v1

摘要

我们探讨了体型如何影响人体动作合成,这一方面在现有的文本到动作生成方法中常被忽视,因为学习同质化的标准体型较为容易。然而,这种同质化会扭曲不同体型与其动作动力学之间的自然相关性。我们的方法通过从自然语言提示生成体型感知的人体动作来填补这一空白。我们利用基于有限标量量化的变分自编码器(FSQ-VAE)将动作量化为离散的标记,然后利用连续的体型信息将这些标记反量化回连续、详细的动作。此外,我们利用预训练语言模型的能力来预测连续的体型参数和动作标记,促进文本对齐动作的合成并将其解码为体型感知的动作。我们对方法进行了定量和定性评估,并进行了全面的感知研究,以证明其在生成体型感知动作方面的有效性。

关键词

引用

@article{arxiv.2504.03639,
  title  = {Shape My Moves: Text-Driven Shape-Aware Synthesis of Human Motions},
  author = {Ting-Hsuan Liao and Yi Zhou and Yu Shen and Chun-Hao Paul Huang and Saayan Mitra and Jia-Bin Huang and Uttaran Bhattacharya},
  journal= {arXiv preprint arXiv:2504.03639},
  year   = {2025}
}

备注

CVPR 2025. Project page: https://shape-move.github.io