基于目标检测的可变量化预处理方法
计算机视觉与模式识别
2020-09-02 v1
摘要
本文针对传统图像与视频编码器提出一种预处理方法,可使这些现有编码器具备内容感知能力。经过我们的处理流程,传统编码器可在不增大输出体积的前提下设置更高的质量参数。静止帧或图像将首先经过目标检测器。若检测结果包含目标,则由检测结果的属性决定后续流程的参数;若给定帧中未检测到目标,则系统直接旁路。该处理方法利用自适应量化过程来确定待丢弃数据的比例。该方法主要基于 JPEG 压缩理论,对 JPEG 编码器及 Motion JPEG 编码器等基于 JPEG 的编码器而言是最优的。然而,其他基于 DCT 的编码器(如 MPEG part 2、H.264 等)也可从该方法中受益。实验中,我们在相同码率下以及相似 MS-SSIM 但增强码率下比较了 MS-SSIM。由于该方法基于人类感知,即便 MS-SSIM 相近,整体观看体验也优于直接编码的结果。
引用
@article{arxiv.2009.00189,
title = {Object Detection-Based Variable Quantization Processing},
author = {Likun Liu and Hua Qi},
journal= {arXiv preprint arXiv:2009.00189},
year = {2020}
}