中文

大型视觉语言模型中的跨文化价值意识

计算机视觉与模式识别 2026-04-14 v1 人工智能 计算与语言

摘要

大型视觉语言模型(LVLMs)的快速普及伴随着日益增长的公平性担忧,因为它们倾向于强化有害的社会偏见。虽然在社会偏见方面已获得广泛关注,但相对缺乏对 LVLMs 关于宗教、国籍和社会经济地位等文化背景相关偏见的研究。在本工作中,我们致力于缩小这一差距,通过检验文化背景在图像中所表达的因素如何影响 LVLMs 对某人道德、伦理和政治价值的判断。我们使用反事实图像集,对五个流行 LVLMs 进行多维度价值判断分析,这些图像集展示了同一人在不同文化背景下的情形。我们的评估框架通过运用道德基础理论、词汇分析以及生成价值对所呈现文化背景的敏感性,诊断 LVLMs 对文化价值差异的意识。

关键词

引用

@article{arxiv.2604.09945,
  title  = {Cross-Cultural Value Awareness in Large Vision-Language Models},
  author = {Phillip Howard and Xin Su and Kathleen C. Fraser},
  journal= {arXiv preprint arXiv:2604.09945},
  year   = {2026}
}