通过图像插值实现视频压缩
计算机视觉与模式识别
2018-04-20 v1
摘要
我们越来越多的数字通信、媒体消费和内容创作围绕视频展开。我们通过视频分享、观看和存档生活的诸多方面,而这一切都由强大的视频压缩技术支撑。传统视频压缩是费力手工设计并手工优化的。本文提出了一种端到端深度学习编解码器的替代方案。我们的编解码器建立在一个简单的想法上:视频压缩是重复的图像插值。因此它受益于深度图像插值与生成的最新进展。我们的深度视频编解码器优于当今主流的编解码器,如H.261、MPEG-4 Part 2,并与H.264性能相当。
引用
@article{arxiv.1804.06919,
title = {Video Compression through Image Interpolation},
author = {Chao-Yuan Wu and Nayan Singhal and Philipp Krähenbühl},
journal= {arXiv preprint arXiv:1804.06919},
year = {2018}
}
备注
Project page: https://chaoyuaw.github.io/vcii/