中文

作为数据的希伯来圣经:实验室—共享—经验

计算与语言 2015-01-09 v1 数字图书馆

摘要

对包括其产生、传播与阐释在内的古代文本的系统研究,自20世纪70年代起步的数字方法极大地提供了助力。但该研究本身又如何传递给新一代研究者?我们讲述了数十年来圣经与计算机的故事,随后指出当前的挑战:(1)为不断变化的计算方法寻找稳定的数据表示;(2)以学科间与学科内的方式共享结果,以实现可复现性与交叉融合。我们报告了应对这些挑战的最新进展。场景是由Eep Talstra圣经与计算机中心(ETCBC)构建的希伯来圣经文本数据库,其在细节与复杂度上仍在不断增长。我们展示了计算要素的微妙组合如何使学者以新方式研究希伯来圣经的传播与阐释:(1)标准数据格式Linguistic Annotation Framework(LAF);(2)科学计算方法,通过(交互式)Python及其相关生态得以易用。此外,我们展示了这些努力如何最终促成新的公开可访问搜索引擎SHEBANQ的构建,其中希伯来圣经文本及其底层数据可用简单而强大的查询语言MQL进行查询,且这些查询可被保存与共享。

关键词

引用

@article{arxiv.1501.01866,
  title  = {The Hebrew Bible as Data: Laboratory - Sharing - Experiences},
  author = {Dirk Roorda},
  journal= {arXiv preprint arXiv:1501.01866},
  year   = {2015}
}

备注

12 pages, 5 figures, follow up on the workshop Biblical Scholarship and Humanities Computing: Data Types, Text, Language and Interpretation, held at the Lorentz Centre Leiden from 6 Feb 2012 through 10 Feb 2012, http://www.lorentzcenter.nl/lc/web/2012/480/report.php3?wsid=480&venue=Oort