中文

计算机视觉与冲突价值:用自动化替代文本描述人物

计算机与社会 2021-05-28 v1 人工智能 计算机视觉与模式识别

摘要

学者们近来提请注意使用计算机视觉自动生成图像中人物描述所引发的一系列争议问题。尽管存在这些担忧,自动图像描述已成为确保盲人和低视力者公平获取信息的重要工具。在本文中,我们调查采用计算机视觉生成替代文本(为盲人和低视力者提供的图像文本描述)的公司所面临的伦理困境。我们以 Facebook 的自动替代文本工具作为主要案例研究。首先,我们分析 Facebook 就种族、性别、年龄等身份类别所采纳的政策,以及该公司关于是否在替代文本中呈现这些术语的决定。然后我们描述博物馆界实践的一种替代——且手动的——方法,聚焦于博物馆如何确定在文化器物的替代文本描述中包含什么。我们比较这些政策,利用显著的对比点发展出一个分析框架,刻画这些政策选择背后的特定忧虑。最后我们通过考量两种似乎规避部分担忧的策略作结,发现没有简易方法能避免由使用计算机视觉自动化替代文本所带来的规范困境。

关键词

引用

@article{arxiv.2105.12754,
  title  = {Computer Vision and Conflicting Values: Describing People with Automated Alt Text},
  author = {Margot Hanley and Solon Barocas and Karen Levy and Shiri Azenkot and Helen Nissenbaum},
  journal= {arXiv preprint arXiv:2105.12754},
  year   = {2021}
}