利用上下文信息进行通用事件边界描述生成
计算机视觉与模式识别
2022-07-05 v1
摘要
通用事件边界描述生成(GEBC)旨在为给定时间边界生成三句描述状态变化的句子。先前的方法一次仅处理单个边界的信息,缺乏对视频上下文信息的利用。为解决此问题,我们设计了一个直接将整段视频作为输入的模型,并并行地为所有边界生成描述。该模型可通过建模边界-边界交互来学习每个时间边界的上下文信息。实验证明了上下文信息的有效性。所提方法在测试集上取得了 72.84 的分数,且我们在该挑战赛中获得了第 名。我们的代码可在:\url{https://github.com/zjr2000/Context-GEBC} 获取。
引用
@article{arxiv.2207.01050,
title = {Exploiting Context Information for Generic Event Boundary Captioning},
author = {Jinrui Zhang and Teng Wang and Feng Zheng and Ran Cheng and Ping Luo},
journal= {arXiv preprint arXiv:2207.01050},
year = {2022}
}