面向跨语言图像标注、描述与检索的COCO-CN数据集
计算与语言
2019-01-16 v2 计算机视觉与模式识别
摘要
本文从数据与基线方法两方面对跨语言图像标注与检索作出贡献。我们提出COCO-CN,一个用人工撰写的中文句子与标签丰富MS-COCO的新数据集。为更有效地获取标注,我们开发了推荐辅助的集体标注系统,自动向标注者提供若干被认为与图像内容相关的标签与句子。COCO-CN拥有20,342张图像、27,218条中文句子与70,993个标签,是目前提供统一且具有挑战性的跨语言图像标注、描述与检索平台的最大中英数据集。我们为从跨语言资源中学习的每项任务开发了概念上简单却有效的方法。在三项任务上的大量实验证明了所提数据集与方法的可行性。数据与代码公开于 https://github.com/li-xirong/coco-cn
引用
@article{arxiv.1805.08661,
title = {COCO-CN for Cross-Lingual Image Tagging, Captioning and Retrieval},
author = {Xirong Li and Chaoxi Xu and Xiaoxu Wang and Weiyu Lan and Zhengxiong Jia and Gang Yang and Jieping Xu},
journal= {arXiv preprint arXiv:1805.08661},
year = {2019}
}
备注
accepted for publication as a regular paper in the IEEE Transactions on Multimedia