利用深度信息提取内窥镜视频关键帧
计算机视觉与模式识别
2021-07-12 v1
摘要
提出一种基于深度学习的单目深度估计(MDE)技术,用于选择内窥镜视频中信息量最大的帧(关键帧)。在大多数情况下,息肉的真实深度图不易获得,因此我们的方法采用迁移学习途径。内窥镜模态通常捕获数千帧。在此情形下,丢弃内窥镜视频中低质量和临床无关帧而保留最具信息量的帧用于临床诊断十分重要。鉴于此,利用息肉的深度信息提出了一种关键帧选择策略。在我们的方法中,图像矩、边缘幅度和关键点被用于自适应选择关键帧。我们所提方法的一个重要应用是可借助提取的关键帧进行息肉的三维重建。此外,借助提取的深度图实现了息肉的定位。
引用
@article{arxiv.2107.00005,
title = {Extraction of Key-frames of Endoscopic Videos by using Depth Information},
author = {Pradipta Sasmal and Avinash Paul and M. K. Bhuyan and Yuji Iwahori},
journal= {arXiv preprint arXiv:2107.00005},
year = {2021}
}