利用句间多样束搜索减少视觉叙事中的冗余
计算与语言
2018-05-31 v1 人工智能
摘要
视觉叙事包含两个重要部分:故事与图像之间的一致性以及故事结构。对于图像到文本的神经网络模型,序列中相似的图像会为故事生成器提供相近的信息,从而产生几乎相同的句子。然而,重复叙述相同物体或事件会破坏良好的故事结构。本文提出一种句间多样束搜索以生成更具表现力的故事。与一些近期不考虑前一张图片所生成句子的视觉叙事任务模型相比,即使给定一系列相似图片,我们提出的方法也能避免生成相同的句子。
引用
@article{arxiv.1805.11867,
title = {Using Inter-Sentence Diverse Beam Search to Reduce Redundancy in Visual Storytelling},
author = {Chao-Chun Hsu and Szu-Min Chen and Ming-Hsun Hsieh and Lun-Wei Ku},
journal= {arXiv preprint arXiv:1805.11867},
year = {2018}
}
备注
Challenge paper in storytelling workshop co-located with NAACL 2018