利用目标检测与语音反馈辅助视障人士
计算机视觉与模式识别
2024-01-04 v1
摘要
对于视障人士而言,在室内外环境中独立、安全地移动极为困难。此外,这些身体和视觉上的障碍也妨碍了他们的日常活动。同样,他们难以感知周围环境中可能带来危险的物体。本文提出的方法通过使用网络摄像头实时检测视频中的物体,用于物体识别过程。采用了基于CNN的实时目标检测技术YOLO(You Look Only Once)模型。此外,使用Python的OpenCV库实现软件程序,并执行深度学习过程。图像识别结果通过Google文本转语音库以音频形式传递给视障用户,并确定物体相对于屏幕位置的位置。使用平均精度均值(mAP)评估所得结果,发现所提方法相比先前方法取得了优异的效果。
引用
@article{arxiv.2401.01362,
title = {Assisting Blind People Using Object Detection with Vocal Feedback},
author = {Heba Najm and Khirallah Elferjani and Alhaam Alariyibi},
journal= {arXiv preprint arXiv:2401.01362},
year = {2024}
}