中文

面向视力障碍人士拍摄图像的显著目标检测

计算机视觉与模式识别 2023-09-07 v2

摘要

显著目标检测是为图像生成一个二值掩膜,以区分哪些像素属于前景目标、哪些属于背景的任务。我们引入了一个新的显著目标检测数据集,该数据集使用视力障碍人士为更好地理解其周围环境而拍摄的图像,我们称之为VizWiz-SalientObject。与现有的七个数据集相比,VizWiz-SalientObject是最大的(即包含32,000张人工标注图像),并具有独特的特征,包括显著目标中文本出现率更高(即68%的图像中存在文本),以及显著目标在图像中占据的比例更大(即平均约50%的覆盖率)。我们在该数据集上对七种现代显著目标检测方法进行了基准测试,发现它们在处理显著目标较大、边界不太复杂、缺乏文本以及低质量图像时最为困难。我们通过在https://vizwiz.org/tasks-and-datasets/salient-object公开分享该数据集,邀请更广泛的研究社区参与我们新的数据集挑战。

关键词

引用

@article{arxiv.2301.05323,
  title  = {Salient Object Detection for Images Taken by People With Vision Impairments},
  author = {Jarek Reynolds and Chandra Kanth Nagesh and Danna Gurari},
  journal= {arXiv preprint arXiv:2301.05323},
  year   = {2023}
}

备注

Computer Vision and Pattern Recognition