面向任务的视频编码:综述
图像与视频处理
2022-11-22 v3 计算机视觉与模式识别
摘要
视频编码技术持续改进,以实现更高分辨率下的更高压缩比。然而,最先进的视频编码标准,如 H.265/HEVC 和 Versatile Video Coding,仍是在压缩视频由人类观看的假设下设计的。随着深度神经网络在解决计算机视觉任务方面的巨大进步与成熟,越来越多视频直接由深度神经网络分析而无需人类参与。当压缩视频被计算机视觉应用使用时,这种传统的视频编码标准设计并非最优。虽然人类视觉系统始终对高对比度内容敏感,但像素对计算机视觉算法的影响由特定计算机视觉任务驱动。在本文中,我们探讨并总结了面向计算机视觉任务的视频编码及新兴视频编码标准 Video Coding for Machines 的最新进展。
引用
@article{arxiv.2208.07313,
title = {Task Oriented Video Coding: A Survey},
author = {Daniel Wood},
journal= {arXiv preprint arXiv:2208.07313},
year = {2022}
}
备注
arXiv admin note: text overlap with arXiv:2201.10162, arXiv:2001.03004, arXiv:2001.03569, arXiv:2110.09241, arXiv:2203.05890, arXiv:2203.05927, arXiv:2106.03511, arXiv:2001.02915, arXiv:2102.01307, arXiv:1812.10067, arXiv:2203.05944, arXiv:2201.02689, arXiv:2105.12653, arXiv:2112.10948, arXiv:1803.05788 by other authors