Computation and Language · Computer Science
KIT's Offline Speech Translation and Instruction Following Submission for IWSLT 2025
Sai Koneru, Maike Züfle, Thai-Binh Nguyen, Seymanur Akti +2
2025-05-20
Audio and Speech Processing · Electrical Eng. & Systems
Interleaved Speech-Text Language Models for Simple Streaming Text-to-Speech Synthesis
Yifan Yang, Shujie Liu, Jinyu Li, Hui Wang +9
2025-08-12
Computation and Language · Computer Science
NAIST Simultaneous Speech Translation System for IWSLT 2024
Yuka Ko, Ryo Fukuda, Yuta Nishikawa, Yasumasa Kano +8
2024-07-02
Audio and Speech Processing · Electrical Eng. & Systems
ESPnet-ST IWSLT 2021 Offline Speech Translation System
Hirofumi Inaguma, Brian Yan, Siddharth Dalmia, Pengcheng Guo +3
2021-07-07
Computation and Language · Computer Science
Scaling Speech-Text Pre-training with Synthetic Interleaved Data
Aohan Zeng, Zhengxiao Du, Mingdao Liu, Lei Zhang +3
2024-12-03
Computation and Language · Computer Science
Scheduled Interleaved Speech-Text Training for Speech-to-Speech Translation with LLMs
Hayato Futami, Emiru Tsunoo, Yosuke Kashiwagi, Yuki Ito +3
2025-06-13
Computation and Language · Computer Science
End-to-End Speech Translation with Pre-trained Models and Adapters: UPC at IWSLT 2021
Gerard I. Gállego, Ioannis Tsiamas, Carlos Escolano, José A. R. Fonollosa +1
2021-06-29
Computation and Language · Computer Science
Unified Speech-Text Pre-training for Speech Translation and Recognition
Yun Tang, Hongyu Gong, Ning Dong, Changhan Wang +7
2022-04-13
Computation and Language · Computer Science
ON-TRAC Consortium Systems for the IWSLT 2022 Dialect and Low-resource Speech Translation Tasks
Marcely Zanon Boito, John Ortega, Hugo Riguidel, Antoine Laurent +7
2022-05-05
Computation and Language · Computer Science
Latent Speech-Text Transformer
Yen-Ju Lu, Yashesh Gaur, Wei Zhou, Benjamin Muller +7
2026-03-11
Audio and Speech Processing · Electrical Eng. & Systems
Towards Efficient Speech-Text Jointly Decoding within One Speech Language Model
Haibin Wu, Yuxuan Hu, Ruchao Fan, Xiaofei Wang +7
2026-02-12
Computation and Language · Computer Science
Aligning Pre-trained Models for Spoken Language Translation
Šimon Sedláček, Santosh Kesiraju, Alexander Polok, Jan Černocký
2024-11-28
Computation and Language · Computer Science
Synchronous Speech Recognition and Speech-to-Text Translation with Interactive Decoding
Yuchen Liu, Jiajun Zhang, Hao Xiong, Long Zhou +4
2019-12-17
Computation and Language · Computer Science
Toward Joint Language Modeling for Speech Units and Text
Ju-Chieh Chou, Chung-Ming Chien, Wei-Ning Hsu, Karen Livescu +4
2023-10-16
Computation and Language · Computer Science
Few-Shot Spoken Language Understanding via Joint Speech-Text Models
Chung-Ming Chien, Mingjiamei Zhang, Ju-Chieh Chou, Karen Livescu
2023-10-10
Computation and Language · Computer Science
NAVER LABS Europe Submission to the Instruction-following Track
Beomseok Lee, Marcely Zanon Boito, Laurent Besacier, Ioan Calapodescu
2025-06-03
Audio and Speech Processing · Electrical Eng. & Systems
Self-Supervised Learning for speech recognition with Intermediate layer supervision
Chengyi Wang, Yu Wu, Sanyuan Chen, Shujie Liu +3
2021-12-17
Computation and Language · Computer Science
Speech Translation with Foundation Models and Optimal Transport: UPC at IWSLT23
Ioannis Tsiamas, Gerard I. Gállego, José A. R. Fonollosa, Marta R. Costa-jussà
2023-06-05
Computation and Language · Computer Science
HITSZ's End-To-End Speech Translation Systems Combining Sequence-to-Sequence Auto Speech Recognition Model and Indic Large Language Model for IWSLT 2025 in Indic Track
Xuchen Wei, Yangxin Wu, Yaoyin Zhang, Henglyu Liu +3
2025-07-29
Computation and Language · Computer Science
TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
Liang-Hsuan Tseng, Yi-Chang Chen, Kuan-Yi Lee, Da-Shan Shiu +1
2026-02-06
Computation and Language · Computer Science
MSLM-S2ST: A Multitask Speech Language Model for Textless Speech-to-Speech Translation with Speaker Style Preservation
Yifan Peng, Ilia Kulikov, Yilin Yang, Sravya Popuri +3
2024-03-20
Computation and Language · Computer Science
Strategies for improving low resource speech to text translation relying on pre-trained ASR models
Santosh Kesiraju, Marek Sarvas, Tomas Pavlicek, Cecile Macaire +1
2024-02-07