利用 GAN 合成咳嗽音频用于 COVID-19 检测
声音
2023-05-09 v1 音频与语音处理
定量方法
摘要
在本毕业设计项目中,目标是为医疗保健领域数据合成的已有研究成果做出贡献。本项目的最终产物是一个训练好的模型,该模型生成可用于扩充医学数据集的合成图像(Pierre, 2021)。本项目所选领域为 Covid-19 咳嗽录音,其已被证明是检测 Covid 的可行数据源。尽管该领域因任务可用数据集有限而极为重要,却仍属未被充分探索的领域。一旦开发出该模型,将通过在使用与不使用扩充数据集的情况下训练 SOTA 模型并衡量性能差异来展示其影响。最后,通过将模型嵌入 Web 应用来整合所有成果以展示其能力。为实现上述目标,将就使用生成模型进行图像合成的近期创新开展广泛的文献综述。
引用
@article{arxiv.2305.04810,
title = {Synthesizing Cough Audio with GAN for COVID-19 Detection},
author = {Yahya Saleh},
journal= {arXiv preprint arXiv:2305.04810},
year = {2023}
}
备注
Bachelor's thesis