中文

以人为中心视频中基于知识引导的短上下文动作预测

计算机视觉与模式识别 2023-09-13 v1 人工智能

摘要

本工作关注长期人类动作预测,特别是利用短视频片段进行预测,这可通过改进建议来加速编辑工作流,并通过叙述建议激发创造力。为此,我们在运行时增强transformer网络注意力机制的某些方面,将符号知识图谱注入该网络,用于视频片段中的动作预测。在两个基准数据集Breakfast和50Salads上的结果表明,我们使用短视频上下文的长期动作预测方法优于当前最先进(SOTA)方法达9%。

关键词

引用

@article{arxiv.2309.05943,
  title  = {Knowledge-Guided Short-Context Action Anticipation in Human-Centric Videos},
  author = {Sarthak Bhagat and Simon Stepputtis and Joseph Campbell and Katia Sycara},
  journal= {arXiv preprint arXiv:2309.05943},
  year   = {2023}
}

备注

ICCV 2023 Workshop on AI for Creative Video Editing and Understanding