Flickr30K 数据集中的刻板印象与偏差
计算与语言
2016-05-20 v1 计算机视觉与模式识别
摘要
Flickr30K 数据集(Young 等,2014)中众包图像描述背后一个未经检验的假设是,它们“只关注可从图像本身获得的信息”(Hodosh 等,2013,第 859 页)。本文提出了一些反对该假设的证据,并提供了可在 Flickr30K 数据集中发现的偏差和不合理推断的列表。最后,它考虑了寻找这些示例的方法,并讨论了在未来的应用中应如何处理由刻板印象驱动的描述。
引用
@article{arxiv.1605.06083,
title = {Stereotyping and Bias in the Flickr30K Dataset},
author = {Emiel van Miltenburg},
journal= {arXiv preprint arXiv:1605.06083},
year = {2016}
}
备注
In: Proceedings of the Workshop on Multimodal Corpora (MMC-2016), pages 1-4. Editors: Jens Edlund, Dirk Heylen and Patrizia Paggio