Computation and Language · Computer Science
Acoustic Data-Driven Subword Modeling for End-to-End Speech Recognition
Wei Zhou, Mohammad Zeineldeen, Zuoyun Zheng, Ralf Schlüter +1
2023-10-24
Audio and Speech Processing · Electrical Eng. & Systems
Subword Regularization: An Analysis of Scalability and Generalization for End-to-End Automatic Speech Recognition
Egor Lakomkin, Jahn Heymann, Ilya Sklyar, Simon Wiesler
2020-08-11
Audio and Speech Processing · Electrical Eng. & Systems
End-to-end Speech-to-Punctuated-Text Recognition
Jumon Nozaki, Tatsuya Kawahara, Kenkichi Ishizuka, Taiichi Hashimoto
2022-07-08
Computation and Language · Computer Science
Towards Unsupervised Speech Recognition Without Pronunciation Models
Junrui Ni, Liming Wang, Yang Zhang, Kaizhi Qian +3
2025-01-10
Computation and Language · Computer Science
MAM: Masked Acoustic Modeling for End-to-End Speech-to-Text Translation
Junkun Chen, Mingbo Ma, Renjie Zheng, Liang Huang
2021-02-10
Audio and Speech Processing · Electrical Eng. & Systems
Confidence Estimation for Attention-based Sequence-to-sequence Models for Speech Recognition
Qiujia Li, David Qiu, Yu Zhang, Bo Li +4
2020-10-27
Computation and Language · Computer Science
End-to-End Word-Level Pronunciation Assessment with MASK Pre-training
Yukang Liang, Kaitao Song, Shaoguang Mao, Huiqiang Jiang +5
2023-06-06
Computation and Language · Computer Science
Study of Semi-supervised Approaches to Improving English-Mandarin Code-Switching Speech Recognition
Pengcheng Guo, Haihua Xu, Lei Xie, Eng Siong Chng
2018-06-19
Computation and Language · Computer Science
End-to-end contextual speech recognition using class language models and a token passing decoder
Zhehuai Chen, Mahaveer Jain, Yongqiang Wang, Michael L. Seltzer +1
2018-12-06
Computation and Language · Computer Science
Transfer Learning from Pre-trained Language Models Improves End-to-End Speech Summarization
Kohei Matsuura, Takanori Ashihara, Takafumi Moriya, Tomohiro Tanaka +3
2023-06-08
Computation and Language · Computer Science
Multi-task Language Modeling for Improving Speech Recognition of Rare Words
Chao-Han Huck Yang, Linda Liu, Ankur Gandhe, Yile Gu +3
2021-09-14
Computation and Language · Computer Science
Instant One-Shot Word-Learning for Context-Specific Neural Sequence-to-Sequence Speech Recognition
Christian Huber, Juan Hussain, Sebastian Stüker, Alexander Waibel
2021-07-07
Audio and Speech Processing · Electrical Eng. & Systems
Enhancing Speech Large Language Models with Prompt-Aware Mixture of Audio Encoders
Weiqiao Shan, Yuang Li, Yuhao Zhang, Yingfeng Luo +8
2025-09-22
Audio and Speech Processing · Electrical Eng. & Systems
High Performance Sequence-to-Sequence Model for Streaming Speech Recognition
Thai-Son Nguyen, Ngoc-Quan Pham, Sebastian Stueker, Alex Waibel
2020-07-28
Information Theory · Computer Science
Improving PPM Algorithm Using Dictionaries
Yichuan Hu, Jianzhong, Zhang, Farooq Khan +1
2015-03-17
Audio and Speech Processing · Electrical Eng. & Systems
Multi-Dialect Speech Recognition With A Single Sequence-To-Sequence Model
Bo Li, Tara N. Sainath, Khe Chai Sim, Michiel Bacchiani +5
2017-12-06
Computation and Language · Computer Science
Towards end-to-end spoken language understanding
Dmitriy Serdyuk, Yongqiang Wang, Christian Fuegen, Anuj Kumar +2
2018-02-26