中文

依赖局域性是否预测印地语非标准词序?

计算与语言 2024-05-14 v1

摘要

先前的研究表明,带有主语-宾语(OSV)顺序的孤立非标准句子在处理难度上比其标准的主语-宾语(SOV)顺序句子更具挑战性。尽管这种困难在合适的语境下会消退,但导致OSV句子处理挑战的认知因素仍是未知的。在本研究中,我们检验了依赖长度最小化是否是非标准(OSV)句法选择的重要预测因素,尤其是在控制信息状态(如给定性和惊讶度)的情况下。我们从印地-乌尔都树库(Hindi-Urdu Treebank, HUTB)中提取包含明确定义主语和宾语的句子,系统性地置换这些句子的前置语素,然后部署分类器来区分原始语料句子与人工生成的替代方案。分类器利用各种基于语境和认知的特征,包括依赖长度、惊讶度和信息状态,以inform其预测。我们的结果表明,尽管在非标准语料句子中存在一种倾向于最小化依赖长度的偏好,但在识别语料句子时,这一因素不显著贡献于惊讶度和给定性措施之外。值得注意的是,语境可预测性成为构成词序偏好的主要决定因素。这些发现得到44名印地语母语者的人类评估的进一步支持。总体而言,本工作阐明了期望适应在词序决策中的作用。我们随后将结果置于话语生产和信息局域性理论中。

关键词

引用

@article{arxiv.2405.07730,
  title  = {Does Dependency Locality Predict Non-canonical Word Order in Hindi?},
  author = {Sidharth Ranjan and Marten van Schijndel},
  journal= {arXiv preprint arXiv:2405.07730},
  year   = {2024}
}

备注

Accepted at CogSci-2024 with full paper publication