中文

利用从文本中挖掘的语言知识改进基于 LSTM 的视频描述

计算与语言 2016-11-30 v2 计算机视觉与模式识别

摘要

本文研究从大型文本语料库挖掘的语言知识如何帮助生成视频的自然语言描述。具体地,我们将在大型文本语料库上训练的神经语言模型和分布语义整合到最近的基于 LSTM 的视频描述架构中。我们在一个 YouTube 视频集合以及两个大型电影描述数据集上评估我们的方法,显示出语法性的显著提升,同时适度改善了描述质量。

关键词

引用

@article{arxiv.1604.01729,
  title  = {Improving LSTM-based Video Description with Linguistic Knowledge Mined from Text},
  author = {Subhashini Venugopalan and Lisa Anne Hendricks and Raymond Mooney and Kate Saenko},
  journal= {arXiv preprint arXiv:1604.01729},
  year   = {2016}
}

备注

Accepted at EMNLP 2016. Project page: http://vsubhashini.github.io/language_fusion.html