基于光学字符识别的语音合成系统的精确性和修订版本:基于 LabVIEW 的实现
声音
2025-06-19 v1 计算与语言
计算机视觉与模式识别
音频与语音处理
摘要
通过声音进行知识提取是一种独特的特性。视力受损者常常只能依赖 NGO 提供的盲文书籍和音频录音。由于这些方法的局限性,盲人往往无法获取所需的书籍。语音是盲人和视力受损者比文本更有效的交流方式,因为他们可以轻松地对声音作出响应。本文 presented了一个精确、可靠、高性价比且用户友好的光学字符识别(OCR)基于语音合成系统。该OCR基于语音的系统是使用实验室虚拟仪器工程工作台(LabVIEW)实现的。
引用
@article{arxiv.2506.15029,
title = {An accurate and revised version of optical character recognition-based speech synthesis using LabVIEW},
author = {Prateek Mehta and Anasuya Patil},
journal= {arXiv preprint arXiv:2506.15029},
year = {2025}
}
备注
9 pages, 9 figures