中文

DISIR:基于交互式精炼的深度图像分割

计算机视觉与模式识别 2020-08-21 v2 人机交互

摘要

本文提出一种用于航拍图像多类分割的交互式方法。具体而言,它基于一个同时利用 RGB 图像与标注的深度神经网络。从仅基于图像的初始输出出发,我们的网络随后通过使用图像与用户标注的拼接来交互式地精炼该分割图。重要的是,用户标注改变的是网络的输入而非其权重,从而实现快速且平滑的过程。通过在两个公开航拍数据集上的实验,我们表明用户标注极为有益:每次点击约修正 5000 个像素。我们分析了框架中不同方面的影响,如标注的表示方式、训练数据量以及网络架构。代码见 https://github.com/delair-ai/DISIR。

关键词

引用

@article{arxiv.2003.14200,
  title  = {DISIR: Deep Image Segmentation with Interactive Refinement},
  author = {Gaston Lenczner and Bertrand Le Saux and Nicola Luminari and Adrien Chan Hon Tong and Guy Le Besnerais},
  journal= {arXiv preprint arXiv:2003.14200},
  year   = {2020}
}

备注

8 pages, 12 figures. Published in the ISPRS Annals of the Photogrammetry, Remote Sensing and Spatial Information Sciences