中文

Reverb:来自Rev的开源ASR和说话人日志

计算与语言 2025-02-26 v3 声音 音频与语音处理

摘要

今天,我们开源了我们的核心语音识别和说话人日志模型,供非商业用途使用。我们同时发布了面向开发者的完整生产流水线和用于实验的简化研究模型。Rev希望这些发布能够刺激语音技术这一快速发展领域的研究和创新。今天发布的语音识别模型在各种长篇语音识别领域均优于所有现有的开源语音识别模型。

关键词

引用

@article{arxiv.2410.03930,
  title  = {Reverb: Open-Source ASR and Diarization from Rev},
  author = {Nishchal Bhandari and Danny Chen and Miguel Ángel del Río Fernández and Natalie Delworth and Jennifer Drexler Fox and Migüel Jetté and Quinten McNamara and Corey Miller and Ondřej Novotný and Ján Profant and Nan Qin and Martin Ratajczak and Jean-Philippe Robichaud},
  journal= {arXiv preprint arXiv:2410.03930},
  year   = {2025}
}