Audio and Speech Processing · Electrical Eng. & Systems
WAVPROMPT: Towards Few-Shot Spoken Language Understanding with Frozen Language Models
Heting Gao, Junrui Ni, Kaizhi Qian, Yang Zhang +2
2022-04-15
Computation and Language · Computer Science
Few-Shot Spoken Language Understanding via Joint Speech-Text Models
Chung-Ming Chien, Mingjiamei Zhang, Ju-Chieh Chou, Karen Livescu
2023-10-10
Audio and Speech Processing · Electrical Eng. & Systems
Few-Shot Speaker Identification Using Depthwise Separable Convolutional Network with Channel Attention
Yanxiong Li, Wucheng Wang, Hao Chen, Wenchang Cao +2
2022-04-26
Computation and Language · Computer Science
Adapting Multilingual Speech Representation Model for a New, Underresourced Language through Multilingual Fine-tuning and Continued Pretraining
Karol Nowakowski, Michal Ptaszynski, Kyoko Murasaki, Jagna Nieuważny
2023-01-19
Audio and Speech Processing · Electrical Eng. & Systems
Parameter Efficient Finetuning for Speech Emotion Recognition and Domain Adaptation
Nineli Lashkarashvili, Wen Wu, Guangzhi Sun, Philip C. Woodland
2024-04-02
Audio and Speech Processing · Electrical Eng. & Systems
A Study of Few-Shot Audio Classification
Piper Wolters, Chris Careaga, Brian Hutchinson, Lauren Phillips
2020-12-04
Computation and Language · Computer Science
A Cross-Lingual Meta-Learning Method Based on Domain Adaptation for Speech Emotion Recognition
David-Gabriel Ion, Răzvan-Alexandru Smădu, Dumitru-Clementin Cercel, Florin Pop +1
2024-10-08
Computation and Language · Computer Science
Emergent Communication Pretraining for Few-Shot Machine Translation
Yaoyiran Li, Edoardo M. Ponti, Ivan Vulić, Anna Korhonen
2024-02-16
Audio and Speech Processing · Electrical Eng. & Systems
Bimodal Speech Emotion Recognition Using Pre-Trained Language Models
Verena Heusser, Niklas Freymuth, Stefan Constantin, Alex Waibel
2019-12-06
Computation and Language · Computer Science
Pathologies of Pre-trained Language Models in Few-shot Fine-tuning
Hanjie Chen, Guoqing Zheng, Ahmed Hassan Awadallah, Yangfeng Ji
2022-04-19
Audio and Speech Processing · Electrical Eng. & Systems
Exploring the influence of fine-tuning data on wav2vec 2.0 model for blind speech quality prediction
Helard Becerra, Alessandro Ragano, Andrew Hines
2022-04-06
Audio and Speech Processing · Electrical Eng. & Systems
Investigating on Incorporating Pretrained and Learnable Speaker Representations for Multi-Speaker Multi-Style Text-to-Speech
Chung-Ming Chien, Jheng-Hao Lin, Chien-yu Huang, Po-chun Hsu +1
2021-05-04
Audio and Speech Processing · Electrical Eng. & Systems
Enhancing Few-shot Keyword Spotting Performance through Pre-Trained Self-supervised Speech Models
Alican Gok, Oguzhan Buyuksolak, Osman Erman Okman, Murat Saraclar
2025-10-09
Computation and Language · Computer Science
End-to-end Whispered Speech Recognition with Frequency-weighted Approaches and Pseudo Whisper Pre-training
Heng-Jui Chang, Alexander H. Liu, Hung-yi Lee, Lin-shan Lee
2020-11-10
Computer Vision and Pattern Recognition · Computer Science
Meta Transfer Learning for Emotion Recognition
Dung Nguyen, Sridha Sridharan, Duc Thanh Nguyen, Simon Denman +2
2020-06-25
Computation and Language · Computer Science
Applying Wav2vec2.0 to Speech Recognition in Various Low-resource Languages
Cheng Yi, Jianzhong Wang, Ning Cheng, Shiyu Zhou +1
2021-01-19