基于音频转录的抽象式摘要
计算与语言
2024-08-12 v1 信息检索
机器学习
音频与语音处理
摘要
当前,大型语言模型正日益普及,其成果被应用于许多领域,从文本翻译到生成查询答案。然而,这些新型机器学习算法的主要问题在于,训练此类模型需要只有大型IT公司才拥有的庞大计算资源。为避免此问题,已提出多种方法(LoRA、量化),以便现有模型能针对特定任务进行高效微调。在本文中,我们提出了一种使用这些技术的端到端 (E2E) 音频摘要模型。此外,本文考察了这些方法对所考虑问题的有效性,并得出了关于这些方法适用性的结论。
引用
@article{arxiv.2408.04639,
title = {Abstractive summarization from Audio Transcription},
author = {Ilia Derkach},
journal= {arXiv preprint arXiv:2408.04639},
year = {2024}
}
备注
36 pages, Master's thesis, 14 figures