精确或模糊:从视觉中学习基数与量词的含义
计算与语言
2017-02-20 v1 人工智能
计算机视觉与模式识别
摘要
人们可以通过使用精确的基数(例如一、二、三)或自然语言量词(例如少数、大多数、全部)来指代视觉场景中的数量。在人类中,这两个过程基于相当不同的认知和神经机制。受此启发,本研究提出了两种模型,用于从包含多个对象的视觉场景中学习基数和量词的客观含义。我们表明,利用“模糊”相似性度量的模型对于学习量词是有效的,而当提供数字信息时,精确基数的学习能更好地完成。
引用
@article{arxiv.1702.05270,
title = {Be Precise or Fuzzy: Learning the Meaning of Cardinals and Quantifiers from Vision},
author = {Sandro Pezzelle and Marco Marelli and Raffaella Bernardi},
journal= {arXiv preprint arXiv:1702.05270},
year = {2017}
}
备注
Accepted at EACL2017. 7 pages