中文

利用目标检测与语音反馈辅助视障人士

计算机视觉与模式识别 2024-01-04 v1

摘要

对于视障人士而言,在室内外环境中独立、安全地移动极为困难。此外,这些身体和视觉上的障碍也妨碍了他们的日常活动。同样,他们难以感知周围环境中可能带来危险的物体。本文提出的方法通过使用网络摄像头实时检测视频中的物体,用于物体识别过程。采用了基于CNN的实时目标检测技术YOLO(You Look Only Once)模型。此外,使用Python的OpenCV库实现软件程序,并执行深度学习过程。图像识别结果通过Google文本转语音库以音频形式传递给视障用户,并确定物体相对于屏幕位置的位置。使用平均精度均值(mAP)评估所得结果,发现所提方法相比先前方法取得了优异的效果。

关键词

引用

@article{arxiv.2401.01362,
  title  = {Assisting Blind People Using Object Detection with Vocal Feedback},
  author = {Heba Najm and Khirallah Elferjani and Alhaam Alariyibi},
  journal= {arXiv preprint arXiv:2401.01362},
  year   = {2024}
}