万物皆可追踪:零样态无遮挡视频对象分割
计算机视觉与模式识别
2026-03-06 v3
摘要
我们提出了 Track Anything Behind Everything (TABE),一种用于零样态无遮挡视频对象分割的新型管道。不同于需要预训练类别标签的现有方法,我们的方法仅使用第一帧中对象可见处的单个查询掩码,即可实现灵活的零样态推理。我们将无遮挥分割建模为从模态(可见)掩码进行生成式填充。我们不需要重新训练扩散模型以适应额外的输入通道,而是使用我们在测试时进行微调以针对跟踪对象进行专业化的预训练模型。我们的 TABE 管道专为处理无遮挥完成而设计,即使在对象完全遮挡的情况下也能正常工作。我们将发布我们的模型和代码。
引用
@article{arxiv.2411.19210,
title = {Track Anything Behind Everything: Zero-Shot Amodal Video Object Segmentation},
author = {Finlay G. C. Hudson and William A. P. Smith},
journal= {arXiv preprint arXiv:2411.19210},
year = {2026}
}