语言模型的词是否具有指称?
计算与语言
2024-03-05 v3
摘要
语言模型(LM)用语言做了什么?大家都同意它们能够生成(大体上)连贯的英文字符串序列。但这些句子是否有意义,还是说 LM 仅仅是在令人信服地模仿语言使用而胡言乱语?在此我们将探讨这一宽泛问题的一个方面:LM 的词是否能够指称,即实现“词到世界”的连接。由于 LM 不像普通语言使用者那样与世界交互,表面上看有理由认为它们不能。借鉴语言哲学中外在论传统的洞见,我们论证此类表象具有误导性:即便 LM 的输入仅仅是文本字符串,它们也是具有自然历史的文本字符串,而这或许足以使 LM 的词与外部世界建立指称性接触。
引用
@article{arxiv.2308.05576,
title = {Do Language Models' Words Refer?},
author = {Matthew Mandelkern and Tal Linzen},
journal= {arXiv preprint arXiv:2308.05576},
year = {2024}
}