Computation and Language · Computer Science
XLS-R Deep Learning Model for Multilingual ASR on Low- Resource Languages: Indonesian, Javanese, and Sundanese
Panji Arisaputra, Alif Tri Handoyo, Amalia Zahra
2024-01-17
Computation and Language · Computer Science
Enhancing Indonesian Automatic Speech Recognition: Evaluating Multilingual Models with Diverse Speech Variabilities
Aulia Adila, Dessi Lestari, Ayu Purwarianti, Dipta Tanaya +2
2024-10-15
Computation and Language · Computer Science
Improved low-resource Somali speech recognition by semi-supervised acoustic and language model training
Astik Biswas, Raghav Menon, Ewald van der Westhuizen, Thomas Niesler
2019-07-09
Audio and Speech Processing · Electrical Eng. & Systems
Anatomy of Industrial Scale Multilingual ASR
Francis McCann Ramirez, Luka Chkhetiani, Andrew Ehrenberg, Robert McHardy +13
2024-04-17
Computation and Language · Computer Science
Benchmarking Automatic Speech Recognition Models for African Languages
Alvin Nahabwe, Sulaiman Kagumire, Denis Musinguzi, Bruno Beijuka +4
2025-12-15
Audio and Speech Processing · Electrical Eng. & Systems
Subword Dictionary Learning and Segmentation Techniques for Automatic Speech Recognition in Tamil and Kannada
Madhavaraj A, Bharathi Pilar, Ramakrishnan A G
2022-07-28
Audio and Speech Processing · Electrical Eng. & Systems
Large-Scale Pre-Training of End-to-End Multi-Talker ASR for Meeting Transcription with Single Distant Microphone
Naoyuki Kanda, Guoli Ye, Yu Wu, Yashesh Gaur +4
2021-04-14
Computation and Language · Computer Science
Leveraging supplementary text data to kick-start automatic speech recognition system development with limited transcriptions
Nay San, Martijn Bartelds, Blaine Billings, Ella de Falco +6
2023-02-13
Audio and Speech Processing · Electrical Eng. & Systems
Massively Multilingual ASR: 50 Languages, 1 Model, 1 Billion Parameters
Vineel Pratap, Anuroop Sriram, Paden Tomasello, Awni Hannun +3
2020-07-09
Audio and Speech Processing · Electrical Eng. & Systems
Towards End-to-End Training of Automatic Speech Recognition for Nigerian Pidgin
Amina Mardiyyah Rufai, Afolabi Abeeb, Esther Oduntan, Tayo Arulogun +2
2025-05-27
Audio and Speech Processing · Electrical Eng. & Systems
Fast Word Error Rate Estimation Using Self-Supervised Representations for Speech and Text
Chanho Park, Chengsong Lu, Mingjie Chen, Thomas Hain
2025-01-30
Computation and Language · Computer Science
Injecting Text in Self-Supervised Speech Pretraining
Zhehuai Chen, Yu Zhang, Andrew Rosenberg, Bhuvana Ramabhadran +2
2021-08-30
Computation and Language · Computer Science
A Reference-less Quality Metric for Automatic Speech Recognition via Contrastive-Learning of a Multi-Language Model with Self-Supervision
Kamer Ali Yuksel, Thiago Ferreira, Ahmet Gunduz, Mohamed Al-Badrashiny +1
2023-06-26
Audio and Speech Processing · Electrical Eng. & Systems
XLSR-Transducer: Streaming ASR for Self-Supervised Pretrained Models
Shashi Kumar, Srikanth Madikeri, Juan Zuluaga-Gomez, Esaú Villatoro-Tello +4
2024-10-10
Computation and Language · Computer Science
Automatic Speech Recognition (ASR) for African Low-Resource Languages: A Systematic Literature Review
Sukairaj Hafiz Imam, Tadesse Destaw Belay, Kedir Yassin Husse, Ibrahim Said Ahmad +6
2025-10-02
Computer Vision and Pattern Recognition · Computer Science
LiteVSR: Efficient Visual Speech Recognition by Learning from Speech Representations of Unlabeled Data
Hendrik Laux, Emil Mededovic, Ahmed Hallawa, Lukas Martin +2
2023-12-18
Audio and Speech Processing · Electrical Eng. & Systems
Pre-training End-to-end ASR Models with Augmented Speech Samples Queried by Text
Eric Sun, Jinyu Li, Jian Xue, Yifan Gong
2023-08-01
Computation and Language · Computer Science
Minimum Word Error Rate Training for Attention-based Sequence-to-Sequence Models
Rohit Prabhavalkar, Tara N. Sainath, Yonghui Wu, Patrick Nguyen +3
2017-12-06