中文

全方位动画:无需对齐的字符动画与图像姿态迁移

计算机视觉与模式识别 2026-05-20 v3

摘要

近期扩散模型的进展大幅提升了基于姿态驱动的字符动画。然而,现有方法局限于具有匹配骨骼结构的空间对齐参考姿态对。处理参考姿态的错位仍是未解之谜。为此,我们提出了One-to-All动画,一个面向任意布局参考的高保真字符动画和图像姿态迁移的统一框架。首先,为了处理空间错位的参考,我们将训练重新表述为自监督的深度填充任务,将多样化的参考布局转换为统一的遮挡输入格式。其次,为了处理部分可见的参考,我们设计了一个参考提取器,用于全面地提取身份特征。进一步,我们集成了混合参考融合注意力机制,以处理不同分辨率和动态序列长度。最后,从生成质量的角度,我们引入了面向身份的姿态控制,将外观与骨骼结构解耦,以缓解姿态过拟合问题,并提出了token替换策略以实现连贯的长视频生成。广泛的实验表明,我们的方法优于现有方法。代码和模型已发布于https://github.com/ssj9596/One-to-All-Animation。

关键词

引用

@article{arxiv.2511.22940,
  title  = {One-to-All Animation: Alignment-Free Character Animation and Image Pose Transfer},
  author = {Shijun Shi and Jing Xu and Zhihang Li and Chunli Peng and Xiaoda Yang and Lijing Lu and Kai Hu and Jiangning Zhang},
  journal= {arXiv preprint arXiv:2511.22940},
  year   = {2026}
}

备注

Project Page:https://ssj9596.github.io/one-to-all-animation-project/