Computation and Language · Computer Science
Memory Augmented Lookup Dictionary based Language Modeling for Automatic Speech Recognition
Yukun Feng, Ming Tu, Rui Xia, Chuanzeng Huang +1
2023-01-03
Audio and Speech Processing · Electrical Eng. & Systems
Enhancing Large Language Model-based Speech Recognition by Contextualization for Rare and Ambiguous Words
Kento Nozawa, Takashi Masuko, Toru Taniguchi
2024-10-14
Computation and Language · Computer Science
Introducing Syllable Tokenization for Low-resource Languages: A Case Study with Swahili
Jesse Atuhurra, Hiroyuki Shindo, Hidetaka Kamigaito, Taro Watanabe
2024-06-25
Audio and Speech Processing · Electrical Eng. & Systems
Subword Dictionary Learning and Segmentation Techniques for Automatic Speech Recognition in Tamil and Kannada
Madhavaraj A, Bharathi Pilar, Ramakrishnan A G
2022-07-28
Audio and Speech Processing · Electrical Eng. & Systems
Better Pseudo-labeling with Multi-ASR Fusion and Error Correction by SpeechLLM
Jeena Prakash, Blessingh Kumar, Kadri Hacioglu, Bidisha Sharma +4
2025-10-06
Audio and Speech Processing · Electrical Eng. & Systems
CMT-LLM: Contextual Multi-Talker ASR Utilizing Large Language Models
Jiajun He, Naoki Sawada, Koichi Miyazaki, Tomoki Toda
2025-06-17
Computation and Language · Computer Science
Improving Speech Recognition for Indic Languages using Language Model
Ankur Dhuriya, Harveen Singh Chadha, Anirudh Gupta, Priyanshi Shah +3
2022-06-16
Computation and Language · Computer Science
Assessing Phrase Break of ESL speech with Pre-trained Language Models
Zhiyi Wang, Shaoguang Mao, Wenshan Wu, Yan Xia
2022-10-31
Computation and Language · Computer Science
AMPS: ASR with Multimodal Paraphrase Supervision
Abhishek Gupta, Amruta Parulekar, Sameep Chattopadhyay, Preethi Jyothi
2025-04-18
Audio and Speech Processing · Electrical Eng. & Systems
Speech Recognition Rescoring with Large Speech-Text Foundation Models
Prashanth Gurunath Shivakumar, Jari Kolehmainen, Aditya Gourav, Yi Gu +3
2024-09-26
Computer Vision and Pattern Recognition · Computer Science
Large Language Models are Strong Audio-Visual Speech Recognition Learners
Umberto Cappellazzo, Minsu Kim, Honglie Chen, Pingchuan Ma +4
2025-03-10
Computer Vision and Pattern Recognition · Computer Science
MMS-LLaMA: Efficient LLM-based Audio-Visual Speech Recognition with Minimal Multimodal Speech Tokens
Jeong Hun Yeo, Hyeongseop Rha, Se Jin Park, Yong Man Ro
2025-06-06
Audio and Speech Processing · Electrical Eng. & Systems
Prompting Large Language Models with Speech Recognition Abilities
Yassir Fathullah, Chunyang Wu, Egor Lakomkin, Junteng Jia +8
2023-07-25
Audio and Speech Processing · Electrical Eng. & Systems
Diarization-Aware Multi-Speaker Automatic Speech Recognition via Large Language Models
Yuke Lin, Ming Cheng, Ze Li, Beilong Tang +1
2025-06-09
Computation and Language · Computer Science
Regional Tiny Stories: Using Small Models to Compare Language Learning and Tokenizer Performance
Nirvan Patil, Malhar Abhay Inamdar, Agnivo Gosai, Guruprasad Pathak +6
2025-04-23
Computation and Language · Computer Science
Scaling Spoken Language Models with Syllabic Speech Tokenization
Nicholas Lee, Cheol Jun Cho, Alan W Black, Gopala K. Anumanchipalli
2026-02-05
Computation and Language · Computer Science
SpeechLLM: Unified Speech and Language Model for Enhanced Multi-Task Understanding in Low Resource Settings
Jaekwon Yoo, Kunal Chandiramani, Divya Tadimeti, Abenezer Girma +1
2025-09-08
Computation and Language · Computer Science
Revisiting Syllables in Language Modelling and their Application on Low-Resource Machine Translation
Arturo Oncevay, Kervy Dante Rivas Rojas, Liz Karen Chavez Sanchez, Roberto Zariquiey
2022-10-07
Computation and Language · Computer Science
Towards ASR Robust Spoken Language Understanding Through In-Context Learning With Word Confusion Networks
Kevin Everson, Yile Gu, Huck Yang, Prashanth Gurunath Shivakumar +9
2024-01-08