重访基于点击的交互式视频对象分割
计算机视觉与模式识别
2022-12-20 v2
摘要
当前交互式视频对象分割(iVOS)方法依赖基于涂鸦的交互来生成精确对象掩码,我们提出一种基于点击的交互式视频对象分割(CiVOS)框架,以尽可能简化所需的用户工作量。CiVOS构建于反映用户交互与掩码传播的解耦模块之上。交互模块将基于点击的交互转换为对象掩码,随后由传播模块推断至剩余帧。额外的用户交互可对对象掩码进行细化。该方法在流行的交互式DAVIS数据集上进行了广泛评估,但不可避免地需将基于涂鸦的交互替换为基于点击的对应交互。我们在评估中考虑了多种生成点击的策略以反映不同用户输入,并调整DAVIS性能度量以进行硬件无关的对比。所提出的CiVOS流程取得了具竞争力的结果,尽管所需用户工作量更低。
引用
@article{arxiv.2203.01784,
title = {Revisiting Click-based Interactive Video Object Segmentation},
author = {Stephane Vujasinovic and Sebastian Bullinger and Stefan Becker and Norbert Scherer-Negenborn and Michael Arens and Rainer Stiefelhagen},
journal= {arXiv preprint arXiv:2203.01784},
year = {2022}
}
备注
ICIP 2022. 5 pages = 4 pages of content + 1 page of references