比较文本分析的复杂性——第四台机器说“园丁总是凶手”
计算与语言
2020-12-15 v1
摘要
关于计算机在映射文本分析复杂性方面能走多远、相较于整个人类研究者团队的能力,存在激烈的争论。对给定文本的“深度”分析仍超出现代计算机的可能性。在现有计算文本分析算法的核心中,存在对实数的运算,例如依据代数域规则的加法与乘法。然而,“比较”这一过程具有非常精确的数学结构,不同于代数域的结构。“比较”的数学结构可通过布尔环来表达。我们基于该结构定义相应的代数方程,将比较文本分析的提升算法置于“正确”的代数基础之上。从这一视角出发,我们能够研究比较文本分析的{\em 计算}复杂性问题。
引用
@article{arxiv.2012.07637,
title = {The Complexity of Comparative Text Analysis -- "The Gardener is always the Murderer" says the Fourth Machine},
author = {Marcus Weber and Konstantin Fackeldey},
journal= {arXiv preprint arXiv:2012.07637},
year = {2020}
}