中文

一种基于联合目标的细粒度图像描述生成方法

计算机视觉与模式识别 2023-11-23 v1 人工智能

摘要

细粒度图像描述生成技术的目标是从图像中学习细节信息,并模拟类人的描述,提供关于图像内容连贯且全面的文本细节。当前此类方法主要面临两个挑战:描述重复与描述遗漏。此外,现有评测指标无法清晰反映模型在这两方面上的表现。为应对这些挑战,我们提出了一种创新的基于联合目标的细粒度图像描述生成模型。进而,我们引入新的基于物体的评测指标,以更直观地评估模型处理描述重复与遗漏的性能。该新方法结合图像级与物体级视觉特征以最大化其优势,并融入物体惩罚机制以减少描述重复。实验结果表明,我们提出的方法显著提升了 CIDEr 评测指标,显示出其在解决描述重复与遗漏问题上的优异性能。

关键词

引用

@article{arxiv.2311.12799,
  title  = {A Fine-Grained Image Description Generation Method Based on Joint Objectives},
  author = {Yifan Zhang and Chunzhen Lin and Donglin Cao and Dazhen Lin},
  journal= {arXiv preprint arXiv:2311.12799},
  year   = {2023}
}