无解码:基于运动矢量的压缩视频跟踪
计算机视觉与模式识别
2026-02-03 v1 人工智能
图像与视频处理
摘要
我们提出一种轻量级的压缩域跟踪模型,直接在视频流上运行,无需进行完整的 RGB 视频解码。通过利用压缩数据中的运动矢量和变换系数,我们的深度模型在帧之间传递对象边界框,较 RGB 基线在 MOTS15/17/20 数据集上实现了达 3.7 倍的计算速度加速,仅出现约 4% 的 [email protected] 下降。这些结果凸显了编解码器域运动建模在大规模监控系统中实现实时分析的效率。
引用
@article{arxiv.2602.00153,
title = {See Without Decoding: Motion-Vector-Based Tracking in Compressed Video},
author = {Axel Duché and Clément Chatelain and Gilles Gasso},
journal= {arXiv preprint arXiv:2602.00153},
year = {2026}
}