中文

利用时空语义一致性进行视频场景解析

计算机视觉与模式识别 2021-09-07 v1

摘要

与图像场景解析相比,视频场景解析引入了时序信息,可有效提升预测的一致性与准确性。本文提出一种时空语义一致性方法以捕获类独占的上下文信息。具体而言,我们设计了一种时空一致性损失来约束空间与时间维度上的语义一致性。此外,我们采用伪标注策略来丰富训练数据集。我们在 VSPW 的开发集(测试部分 1)和测试集上分别取得了 59.84% 和 58.85% 的 mIoU。我们的方法在 ICCV2021 的 VSPW 挑战赛中获得第一名。

关键词

引用

@article{arxiv.2109.02281,
  title  = {Exploiting Spatial-Temporal Semantic Consistency for Video Scene Parsing},
  author = {Xingjian He and Weining Wang and Zhiyong Xu and Hao Wang and Jie Jiang and Jing Liu},
  journal= {arXiv preprint arXiv:2109.02281},
  year   = {2021}
}

备注

1st Place technical report for "The 1st Video Scene Parsing in the Wild Challenge" at ICCV2021