Audio and Speech Processing · Electrical Eng. & Systems
Investigating Stochastic Methods for Prosody Modeling in Speech Synthesis
Paul Mayer, Florian Lux, Alejandro Pérez-González-de-Martos, Angelina Elizarova +3
2025-07-02
Audio and Speech Processing · Electrical Eng. & Systems
Cross-lingual Prosody Transfer for Expressive Machine Dubbing
Jakub Swiatkowski, Duo Wang, Mikolaj Babianski, Patrick Lumban Tobing +2
2023-06-21
Sound · Computer Science
MsEmoTTS: Multi-scale emotion transfer, prediction, and control for emotional speech synthesis
Yi Lei, Shan Yang, Xinsheng Wang, Lei Xie
2022-01-19
Audio and Speech Processing · Electrical Eng. & Systems
Controllable Neural Prosody Synthesis
Max Morrison, Zeyu Jin, Justin Salamon, Nicholas J. Bryan +1
2020-08-13
Computation and Language · Computer Science
ProsodyLM: Uncovering the Emerging Prosody Processing Capabilities in Speech Language Models
Kaizhi Qian, Xulin Fan, Junrui Ni, Slava Shechtman +3
2025-08-11
Computation and Language · Computer Science
Improving French Synthetic Speech Quality via SSML Prosody Control
Nassima Ould Ouali, Awais Hussain Sani, Ruben Bueno, Jonah Dauvet +2
2025-08-26
Artificial Intelligence · Computer Science
Learning Compositional Rules via Neural Program Synthesis
Maxwell I. Nye, Armando Solar-Lezama, Joshua B. Tenenbaum, Brenden M. Lake
2020-10-26
Robotics · Computer Science
Emotional Speech Synthesis for Companion Robot to Imitate Professional Caregiver Speech
Takeshi Homma, Qinghua Sun, Takuya Fujioka, Ryuta Takawaki +4
2024-10-28
Audio and Speech Processing · Electrical Eng. & Systems
Prosody Learning Mechanism for Speech Synthesis System Without Text Length Limit
Zhen Zeng, Jianzong Wang, Ning Cheng, Jing Xiao
2020-08-14
Audio and Speech Processing · Electrical Eng. & Systems
Enhancing In-the-Wild Speech Emotion Conversion with Resynthesis-based Duration Modeling
Navin Raj Prabhu, Danilo de Oliveira, Nale Lehmann-Willenbrock, Timo Gerkmann
2025-08-18
Computation and Language · Computer Science
ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech Synthesis
Xiangheng He, Junjie Chen, Zixing Zhang, Björn W. Schuller
2024-12-20
Computer Vision and Pattern Recognition · Computer Science
MFCC based Enlargement of the Training Set for Emotion Recognition in Speech
Inma Mohino-Herranz, Roberto Gil-Pita, Sagrario Alonso-Diaz, Manuel Rosa-Zurera
2014-03-20