Computation and Language · Computer Science
CASPER: A Large Scale Spontaneous Speech Dataset
Cihan Xiao, Ruixing Liang, Xiangyu Zhang, Mehmet Emre Tiryaki +7
2025-06-12
Computation and Language · Computer Science
Adapting an ASR Foundation Model for Spoken Language Assessment
Rao Ma, Mengjie Qian, Mark J. F. Gales, Kate M. Knill
2023-10-11
Audio and Speech Processing · Electrical Eng. & Systems
SpeechBrain: A General-Purpose Speech Toolkit
Mirco Ravanelli, Titouan Parcollet, Peter Plantinga, Aku Rouhe +17
2021-06-10
Audio and Speech Processing · Electrical Eng. & Systems
In-Sync: Adaptation of Speech Aware Large Language Models for ASR with Word Level Timestamp Predictions
Xulin Fan, Vishal Sunder, Samuel Thomas, Mark Hasegawa-Johnson +2
2026-04-28
Computation and Language · Computer Science
A Survey of Available Corpora for Building Data-Driven Dialogue Systems
Iulian Vlad Serban, Ryan Lowe, Peter Henderson, Laurent Charlin +1
2017-03-22
Audio and Speech Processing · Electrical Eng. & Systems
Game-Time: Evaluating Temporal Dynamics in Spoken Language Models
Kai-Wei Chang, En-Pei Hu, Chun-Yi Kuan, Wenze Ren +6
2026-05-04
Computation and Language · Computer Science
SLUE: New Benchmark Tasks for Spoken Language Understanding Evaluation on Natural Speech
Suwon Shon, Ankita Pasad, Felix Wu, Pablo Brusco +3
2022-08-01
Audio and Speech Processing · Electrical Eng. & Systems
Time and Tokens: Benchmarking End-to-End Speech Dysfluency Detection
Xuanru Zhou, Jiachen Lian, Cheol Jun Cho, Jingwen Liu +9
2024-09-23
Computation and Language · Computer Science
Teach me with a Whisper: Enhancing Large Language Models for Analyzing Spoken Transcripts using Speech Embeddings
Fatema Hasan, Yulong Li, James Foulds, Shimei Pan +1
2023-11-14
Computational Engineering, Finance, and Science · Computer Science
A Language Model-Guided Framework for Mining Time Series with Distributional Shifts
Haibei Zhu, Yousef El-Laham, Elizabeth Fons, Svitlana Vyetrenko
2024-06-11
Audio and Speech Processing · Electrical Eng. & Systems
Auto-Landmark: Acoustic Landmark Dataset and Open-Source Toolkit for Landmark Extraction
Xiangyu Zhang, Daijiao Liu, Tianyi Xiao, Cihan Xiao +4
2025-05-26
Audio and Speech Processing · Electrical Eng. & Systems
VoxSim: A perceptual voice similarity dataset
Junseok Ahn, Youkyum Kim, Yeunju Choi, Doyeop Kwak +3
2024-07-29
Computation and Language · Computer Science
Speak or Chat with Me: End-to-End Spoken Language Understanding System with Flexible Inputs
Sujeong Cha, Wangrui Hou, Hyun Jung, My Phung +4
2021-06-15
Computation and Language · Computer Science
Languages in Whisper-Style Speech Encoders Align Both Phonetically and Semantically
Ryan Soh-Eun Shim, Domenico De Cristofaro, Chengzhi Martin Hu, Alessandro Vietti +1
2026-04-07
Computation and Language · Computer Science
SpeechBERT: An Audio-and-text Jointly Learned Language Model for End-to-end Spoken Question Answering
Yung-Sung Chuang, Chi-Liang Liu, Hung-Yi Lee, Lin-shan Lee
2020-08-12
Computation and Language · Computer Science
SLURP: A Spoken Language Understanding Resource Package
Emanuele Bastianelli, Andrea Vanzo, Pawel Swietojanski, Verena Rieser
2020-11-30
Audio and Speech Processing · Electrical Eng. & Systems
SynParaSpeech: Automated Synthesis of Paralinguistic Datasets for Speech Generation and Understanding
Bingsong Bai, Qihang Lu, Wenbing Yang, Zihan Sun +7
2025-09-30
Computation and Language · Computer Science
ASR Benchmarking: Need for a More Representative Conversational Dataset
Gaurav Maheshwari, Dmitry Ivanov, Théo Johannet, Kevin El Haddad
2024-09-19
Artificial Intelligence · Computer Science
Towards measuring fairness in speech recognition: Fair-Speech dataset
Irina-Elena Veliche, Zhuangqun Huang, Vineeth Ayyat Kochaniyan, Fuchun Peng +2
2024-08-26