中文

RITA:面向实时交互式说话人形头像的框架

计算机视觉与模式识别 2024-06-21 v1 人工智能 人机交互

摘要

RITA 提供了一个基于生成模型构建的高质量实时交互式框架,注重实际应用。在本框架中,用户上传的照片可被转换为能够进行实时对话交互的数字化身。通过利用最新的生成模型技术,我们开发了一个多功能平台,不仅通过动态对话化身提升用户体验,还为虚拟现实、在线教育和交互式游戏等新应用开辟了新的途径。本 work 展示了将计算机视觉和自然语言处理技术集成以创建沉浸式交互式数字人格的潜力,推动了我们与数字内容交互方式的边界。

关键词

引用

@article{arxiv.2406.13093,
  title  = {RITA: A Real-time Interactive Talking Avatars Framework},
  author = {Wuxinlin Cheng and Cheng Wan and Yupeng Cao and Sihan Chen},
  journal= {arXiv preprint arXiv:2406.13093},
  year   = {2024}
}