从识别到预测:视频中人体动作与轨迹预测的分析
计算机视觉与模式识别
2021-07-19 v3
摘要
随着计算机视觉深度学习的进步,系统如今能够分析视频中前所未有的丰富视觉信息,从而赋能自动驾驶、具社会感知的机器人助手与公共安全监控等应用。在这些应用中,解读人体行为以从视频预测其未来路径/轨迹及将为之的动作十分重要。然而,人体轨迹预测仍是一项挑战性任务,因为场景语义与人的意图难以建模。许多系统不提供高层语义属性来推理行人的未来。这一设计阻碍了在来自不同领域与未见过场景的视频数据上的预测性能。为实现最优的未来人体行为预测,系统必须能够检测并分析人体活动及场景语义,将信息性特征传递至后续预测模块以理解上下文。
引用
@article{arxiv.2011.10670,
title = {From Recognition to Prediction: Analysis of Human Action and Trajectory Prediction in Video},
author = {Junwei Liang},
journal= {arXiv preprint arXiv:2011.10670},
year = {2021}
}
备注
Ph.D. Thesis. Version 2: Defense. See here: https://junweiliang.github.io/thesis/