中文

LibriWASN:用于异步记录设备下会议分离、说话人日记化与识别的数据集

声音 2023-08-22 v1 计算与语言 音频与语音处理

摘要

我们提出 LibriWASN,一个设计紧密遵循 LibriCSS 会议识别数据集的数据集,其显著区别在于数据由随机放置在会议桌上且采样时钟未同步的设备录制。使用了九种不同设备,包括五个单录音通道的智能手机和四个麦克风阵列,共录制 29 个通道。除此之外,该数据集紧密遵循 LibriCSS 设计:相同的 LibriSpeech 语句由环绕会议桌的八个扬声器播放,数据按不同语音重叠百分比的子集组织。LibriWASN 旨在作为时钟同步算法、会议分离、日记化与转写系统在自组织无线声学传感器网络上的测试集。由于其与 LibriCSS 的相似性,为后者开发的会议转写系统可直接在 LibriWASN 上测试。该数据集在两个不同房间录制,并补充了谁在何时说话的地面真值日记化信息。

关键词

引用

@article{arxiv.2308.10682,
  title  = {LibriWASN: A Data Set for Meeting Separation, Diarization, and Recognition with Asynchronous Recording Devices},
  author = {Joerg Schmalenstroeer and Tobias Gburrek and Reinhold Haeb-Umbach},
  journal= {arXiv preprint arXiv:2308.10682},
  year   = {2023}
}

备注

Accepted for presentation at the ITG conference on Speech Communication 2023