Machine Learning · Computer Science
W2v-BERT: Combining Contrastive Learning and Masked Language Modeling for Self-Supervised Speech Pre-Training
Yu-An Chung, Yu Zhang, Wei Han, Chung-Cheng Chiu +3
2021-09-15
Computation and Language · Computer Science
wav2vec: Unsupervised Pre-training for Speech Recognition
Steffen Schneider, Alexei Baevski, Ronan Collobert, Michael Auli
2019-09-12
Machine Learning · Computer Science
Efficient Self-supervised Learning with Contextualized Target Representations for Vision, Speech and Language
Alexei Baevski, Arun Babu, Wei-Ning Hsu, Michael Auli
2023-06-16
Audio and Speech Processing · Electrical Eng. & Systems
Wav2vec-C: A Self-supervised Model for Speech Representation Learning
Samik Sadhu, Di He, Che-Wei Huang, Sri Harish Mallidi +5
2021-06-25
Machine Learning · Computer Science
Unsupervised speech representation learning using WaveNet autoencoders
Jan Chorowski, Ron J. Weiss, Samy Bengio, Aäron van den Oord
2019-09-12
Computer Vision and Pattern Recognition · Computer Science
Learning Representations by Predicting Bags of Visual Words
Spyros Gidaris, Andrei Bursuc, Nikos Komodakis, Patrick Pérez +1
2020-02-28
Computation and Language · Computer Science
Self-supervised Learning with Random-projection Quantizer for Speech Recognition
Chung-Cheng Chiu, James Qin, Yu Zhang, Jiahui Yu +1
2022-07-01
Computation and Language · Computer Science
An Information-Theoretic Analysis of Self-supervised Discrete Representations of Speech
Badr M. Abdullah, Mohammed Maqsood Shaik, Bernd Möbius, Dietrich Klakow
2023-06-06
Computation and Language · Computer Science
wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations
Alexei Baevski, Henry Zhou, Abdelrahman Mohamed, Michael Auli
2020-10-23
Computation and Language · Computer Science
Unsupervised Speech Recognition
Alexei Baevski, Wei-Ning Hsu, Alexis Conneau, Michael Auli
2022-05-04
Computation and Language · Computer Science
Wav-BERT: Cooperative Acoustic and Linguistic Representation Learning for Low-Resource Speech Recognition
Guolin Zheng, Yubei Xiao, Ke Gong, Pan Zhou +2
2021-10-12
Audio and Speech Processing · Electrical Eng. & Systems
Audio ALBERT: A Lite BERT for Self-supervised Learning of Audio Representation
Po-Han Chi, Pei-Hung Chung, Tsung-Han Wu, Chun-Cheng Hsieh +3
2021-05-04
Neurons and Cognition · Quantitative Biology
Toward a realistic model of speech processing in the brain with self-supervised learning
Juliette Millet, Charlotte Caucheteux, Pierre Orhan, Yves Boubenec +4
2023-03-21
Computation and Language · Computer Science
HuBERT: Self-Supervised Speech Representation Learning by Masked Prediction of Hidden Units
Wei-Ning Hsu, Benjamin Bolte, Yao-Hung Hubert Tsai, Kushal Lakhotia +2
2021-06-15
Audio and Speech Processing · Electrical Eng. & Systems
On the Use of Self-Supervised Representation Learning for Speaker Diarization and Separation
Séverin Baroudi, Hervé Bredin, Joseph Razik, Ricard Marxer
2025-12-18
Computation and Language · Computer Science
Wav2Seq: Pre-training Speech-to-Text Encoder-Decoder Models Using Pseudo Languages
Felix Wu, Kwangyoun Kim, Shinji Watanabe, Kyu Han +3
2022-05-03