中文

源自语义学与语用学的 TTS 表现力

计算与语言 2018-03-21 v1

摘要

在本文中,我们展示了正在进行的工作,旨在开发一个富有表现力的 TTS 阅读器,可同时应用于文本和对话系统。名为 SPARSAR 的系统迄今为止已被用于朗读(英语)诗歌,但现在它可以应用于任何文本。该文本在语音学与音系学层面,以及句法与语义学层面均得到了全面分析。此外,该系统可访问一个受限的典型语用标记短语和表达列表,这些短语和表达用于传达特定的语篇功能和言语行为,并需要专门的语调轮廓。文本被转换为类似诗歌的结构,其中每一行对应一个在语义和句法上一致的呼吸群。诗节对应于段落边界。类比参数与 ToBI 理论指数相关,但其数量增加了一倍。在本文中,我们重点关注短篇小说和寓言。

关键词

引用

@article{arxiv.1803.07295,
  title  = {Expressivity in TTS from Semantics and Pragmatics},
  author = {Rodolfo Delmonte},
  journal= {arXiv preprint arXiv:1803.07295},
  year   = {2018}
}

备注

Presented at AISV 2015 - Now appearing in Studi AISV, n.1