面向牙科介入的多任务视频增强
计算机视觉与模式识别
2022-10-31 v1 机器学习
图像与视频处理
摘要
牢固安装于牙科手机上的微型摄像头可使牙医持续监测保守性牙科操作的进展。在视频辅助牙科介入中,视频增强可缓解低光照、噪声、模糊和相机抖动等共同降低视觉舒适性的问题。为此,我们提出了一种用于多任务视频增强的新型深度网络,可实现牙科场景的宏观可视化。具体而言,所提网络以多尺度方式联合利用视频复原与时间对齐来实现有效的视频增强。我们在仿真场景中老年人自然牙齿视频上的实验表明,所提网络在多项任务中取得了最先进的(state-of-the-art)结果,且具备近实时处理能力。我们发布了 Vident-lab(https://doi.org/10.34808/1jby-ay90),这是首个带有多任务标签的牙科视频数据集,以促进相关视频处理应用中的进一步研究。
引用
@article{arxiv.2210.16236,
title = {Multi-task Video Enhancement for Dental Interventions},
author = {Efklidis Katsaros and Piotr K. Ostrowski and Krzysztof Włódarczak and Emilia Lewandowska and Jacek Ruminski and Damian Siupka-Mróz and Łukasz Lassmann and Anna Jezierska and Daniel Węsierski},
journal= {arXiv preprint arXiv:2210.16236},
year = {2022}
}
备注
Accepted at MICCAI 2022: https://link.springer.com/chapter/10.1007/978-3-031-16449-1_18