中文

从语言变迁的 S 曲线中提取信息

物理与社会 2014-10-31 v2 计算与语言 数据分析、统计与概率

摘要

人们普遍接受,创新的采用由 S 曲线(缓慢开始、加速期和缓慢结束)来描述。在本文中,我们分析了通过对 S 曲线的定量描述可以获得多少关于创新传播动力学的信息。我们专注于语言创新的采用,过去 200 年详细书面文本数据库的存在使得前所未有的统计精度成为可能。结合数据分析与简单模型(例如复杂网络上的 Bass 动力学)的模拟,我们在采用的 S 曲线中识别出了内源性和外源性因素的特征。我们提出了一种量化这些因素强度的度量,以及三种从 S 曲线估计该强度的方法。我们获得了外源性因素占主导的案例(在德语正字法改革和一个不规则动词的采用中)以及内源性因素占主导的案例(在俄语名字罗马化惯例的采用和大多数研究动词的规则化中)。这些结果表明,S 曲线的形状并非普遍适用,且包含有关采用机制的信息。(发表于 "J. R. Soc. Interface, vol. 11, no. 101, (2014) 1044"; DOI: http://dx.doi.org/10.1098/rsif.2014.1044)

关键词

引用

@article{arxiv.1406.4498,
  title  = {Extracting information from S-curves of language change},
  author = {Fakhteh Ghanbarnejad and Martin Gerlach and Jose M. Miotto and Eduardo G. Altmann},
  journal= {arXiv preprint arXiv:1406.4498},
  year   = {2014}
}

备注

9 pages, 5 figures, Supplementary Material is available at http://dx.doi.org/10.6084/m9.figshare.1221782