证词的形式:口述历史档案比较的可扩展框架
人工智能
2026-05-22 v1
摘要
大屠杀研究中的学者经常区分两种口述幸存者证词风格:南加州大学Shoah基金会的访谈倾向于遵循结构化的、采访者引导的格式,而耶鲁Fortunoff视频档案通常偏爱更自由形式、开放式的风格。这种区分影响了学术研究和后来档案的发展。在本研究中,我们通过大规模计算分析来自两个收藏的1600多份证词来批判性地检验这一说法。利用话语分割、主题建模和基于大语言模型(LLM)的分析,我们通过主题连贯性、采访者-幸存者动态和问题类型分布来量化证词的“结构化程度”。我们的结果总体上证实了早期研究中识别的结构差异,同时也揭示了两个收藏之间的显著重叠,无论是在单个访谈内部还是跨常见叙事模式。这使通常应用于这些口述历史的简单“结构化与自由形式”二分法变得复杂。除了重新审视大屠杀研究中的一个基础性主张外,我们的工作为比较语料库分析提供了一个可扩展、可复制的框架。作为概念验证,它暗示了数字口述历史、叙事分析和公民科学注释平台设计的更广泛应用。
引用
@article{arxiv.2605.21623,
title = {The Shape of Testimony: A Scalable Framework for Oral History Archive Comparison},
author = {Itamar Trainin and Renana Keydar and Amit Pinchevski},
journal= {arXiv preprint arXiv:2605.21623},
year = {2026}
}