中文

神曲的音节划分

计算与语言 2020-10-27 v1

摘要

我们提供一种利用概率与约束规划技术为《神曲》划分音节的算法。我们特别关注跨音省略(synalephe),从其与相邻词参与跨音省略的“倾向性”角度加以处理。我们联合提供一个在线词汇表,其中对每个词包含其音节划分、重音位置信息,以及前述左右两侧的跨音省略倾向性。该算法本质为非确定性,为每首诗节产生具不同似然的多种可能音节划分;关于第10、4与6音节上重音的格律约束被用于进一步缩减解空间。因此,最具似然的音节划分作为输出返回。我们相信本工作可成为诸多不同研究的重大里程碑。从数字人文视角,它为计算机辅助数字源分析开启新前景,包括异常与问题案例的自动检测、诗节的格律聚类及其分类,或更基础的研究(如辅音与元音的语音作用)。从文本处理与深度学习视角,关于音节划分与重音位置的信息开启了广泛令人振奋的前景,从自动学习词与诗节的音节划分,到改进感知格律问题且更尊重预期音乐性的生成模型。

关键词

引用

@article{arxiv.2010.13515,
  title  = {Syllabification of the Divine Comedy},
  author = {Andrea Asperti and Stefano Dal Bianco},
  journal= {arXiv preprint arXiv:2010.13515},
  year   = {2020}
}