中文

Flickr30K 数据集中的刻板印象与偏差

计算与语言 2016-05-20 v1 计算机视觉与模式识别

摘要

Flickr30K 数据集(Young 等,2014)中众包图像描述背后一个未经检验的假设是,它们“只关注可从图像本身获得的信息”(Hodosh 等,2013,第 859 页)。本文提出了一些反对该假设的证据,并提供了可在 Flickr30K 数据集中发现的偏差和不合理推断的列表。最后,它考虑了寻找这些示例的方法,并讨论了在未来的应用中应如何处理由刻板印象驱动的描述。

关键词

引用

@article{arxiv.1605.06083,
  title  = {Stereotyping and Bias in the Flickr30K Dataset},
  author = {Emiel van Miltenburg},
  journal= {arXiv preprint arXiv:1605.06083},
  year   = {2016}
}

备注

In: Proceedings of the Workshop on Multimodal Corpora (MMC-2016), pages 1-4. Editors: Jens Edlund, Dirk Heylen and Patrizia Paggio