自然语言预群模型中的信息流
计算与语言
2018-11-09 v1 形式语言与自动机理论
摘要
本文关于自然语言的预群(pregroup)模型,以及它们如何与组合分布语义和自然语言处理中预群的显式范畴化使用相关联。这些范畴化解释对自然语言的本质做了某些假设,当形式化表述时,可视为对自然语言的预群文法施加了强限制。我们将其形式化为关于自然语言预群模型必须采取的形式的假设,并通过一个人工语言示例表明这些限制并非由预群公理本身所强加。我们对比该人工语言示例与自然语言(以威尔士语——一种不能将“名词”类型视为原初类型的语言——作为说明性示例)。该假设简而言之即:在以传递信息为目的的语言中,句子中的词之间必须存在因果连接或信息流。这对于仅由一系列“无意义”规则生成的形式语言则未必成立。这对我们在自然语言中所期望发现的预群文法类型施加了限制;我们以代数、范畴与图论术语将其形式化。我们为提供确保预群模型满足这些猜想性质的条件采取了初步步骤,并讨论了该假设可能采取的更一般形式。
引用
@article{arxiv.1811.03273,
title = {Information Flow in Pregroup Models of Natural Language},
author = {Peter M. Hines},
journal= {arXiv preprint arXiv:1811.03273},
year = {2018}
}
备注
In Proceedings CAPNS 2018, arXiv:1811.02701