B(eo)W(u)LF:促进多层级语言的递归分析
计算与语言
2013-08-14 v1
摘要
话语分析不仅旨在刻画给定文本的整体构成,还致力于揭示数据内部的动态模式。本技术报告介绍了一种旨在促进多层级调查的数据格式,我们称之为逐词长格式(by-word long-form)或 B(eo)W(u)LF。受混合效应建模所需的长格式数据启发,B(eo)W(u)LF 将语言数据结构化为一个扩展矩阵,用于编码任意数量的研究者指定标记,使其成为基于递归分析的理想选择。虽然我们不一定声称是首个使用此类方法的研究者,但我们创建了一系列利用 Python 和 MATLAB 的工具以实现此类话语分析,并使用 319 行译为现代英语的古英语史诗《贝奥武夫》(Beowulf)进行了演示。
引用
@article{arxiv.1308.2696,
title = {B(eo)W(u)LF: Facilitating recurrence analysis on multi-level language},
author = {A. Paxton and R. Dale},
journal= {arXiv preprint arXiv:1308.2696},
year = {2013}
}
备注
3 pages plus 6 appendices (including code and sample data)