中文

基于音频转录的抽象式摘要

计算与语言 2024-08-12 v1 信息检索 机器学习 音频与语音处理

摘要

当前,大型语言模型正日益普及,其成果被应用于许多领域,从文本翻译到生成查询答案。然而,这些新型机器学习算法的主要问题在于,训练此类模型需要只有大型IT公司才拥有的庞大计算资源。为避免此问题,已提出多种方法(LoRA、量化),以便现有模型能针对特定任务进行高效微调。在本文中,我们提出了一种使用这些技术的端到端 (E2E) 音频摘要模型。此外,本文考察了这些方法对所考虑问题的有效性,并得出了关于这些方法适用性的结论。

关键词

引用

@article{arxiv.2408.04639,
  title  = {Abstractive summarization from Audio Transcription},
  author = {Ilia Derkach},
  journal= {arXiv preprint arXiv:2408.04639},
  year   = {2024}
}

备注

36 pages, Master's thesis, 14 figures