基于记忆的视频场景解析
计算机视觉与模式识别
2021-09-02 v1
摘要
视频场景解析是计算机视觉中一项长期具有挑战性的任务,旨在为给定视频所有帧的像素分配预定义的语义标签。与图像语义分割相比,该任务更关注如何利用时序信息以获得更高的预测精度。在本报告中,我们介绍了针对首届野外视频场景解析挑战赛的解决方案,其取得了57.44的mIoU并获得第二名(我们的团队名为CharlesBLWX)。
引用
@article{arxiv.2109.00373,
title = {Memory Based Video Scene Parsing},
author = {Zhenchao Jin and Dongdong Yu and Kai Su and Zehuan Yuan and Changhu Wang},
journal= {arXiv preprint arXiv:2109.00373},
year = {2021}
}
备注
technical report for "The 1st Video Scene Parsing in the Wild Challenge Workshop". arXiv admin note: text overlap with arXiv:2108.11819