中文

每个人都喜欢睡觉:基于30种语言对象的命名数据的计算机辅助比较

计算与语言 2025-08-22 v2

摘要

对象命名——用单词或短语识别对象的行为——是人类沟通中基本技能,相关且适用于诸多学科,如心理语言学、认知语言学或语言和视觉研究。对象命名数据集由概念列表与图片配对组成,用于洞察人类如何访问和选择周围对象的名称,以及研究将视觉刺激转化为语义概念的认知过程。不幸的是,对象命名数据集常常缺乏透明度且结构高度具特定性。我们的研究尝试通过一种多语言、计算机辅助的方法,将对象命名列表的 individual 项目链接到统一概念上,以实现当前对象命名数据的透明度和可比性。我们的当前样本链接了17个对象命名数据集,覆盖30种语言,来自10个不同的语言族。我们说明了如何通过搜索在大多数数据集中重复出现的概念以及将覆盖的对象命名数据集的概念空间与历史语言学和语言类型学中的经典基本词汇表进行比较来探索比较数据集。我们的发现可作为增强跨语言对象命名研究的基础,以及未来处理对象命名任务的指南。

关键词

引用

@article{arxiv.2501.08312,
  title  = {Everybody Likes to Sleep: A Computer-Assisted Comparison of Object Naming Data from 30 Languages},
  author = {Alžběta Kučerová and Johann-Mattis List},
  journal= {arXiv preprint arXiv:2501.08312},
  year   = {2025}
}

备注

To appear in the Proceedings of the Global WordNet Conference 2025