中文

VAQUUM:模糊量词是否植根于视觉数据?

计算与语言 2025-06-26 v3

摘要

"少数"和"许多"等模糊量词受到各种语境因素的影响,包括给定语境中物体的数量。在这项工作中,我们评估了视觉-语言模型(VLMs)在视觉语境中生成或判断模糊量词适当性时与人类的兼容程度。我们发布了一个名为VAQUUM的新数据集,包含跨1089张图像的20300个人类评分。使用该数据集,我们通过三种不同的评估方法比较了人类判断和VLM预测。我们的结果表明,VLMs和人类一样,在模糊量词的使用中受到物体数量的影响。然而,我们发现不同模型在不同评估设置中存在显著不一致,这表明判断和生成模糊量词依赖于两个不同的过程。

关键词

引用

@article{arxiv.2502.11874,
  title  = {VAQUUM: Are Vague Quantifiers Grounded in Visual Data?},
  author = {Hugh Mee Wong and Rick Nouwen and Albert Gatt},
  journal= {arXiv preprint arXiv:2502.11874},
  year   = {2025}
}

备注

Proceedings of ACL 2025, 10 pages