半自动转录在语料库创建中有用吗?关于KIParla语料库的初步探讨
计算与语言
2026-03-18 v1
摘要
本文分析了自动语音识别(ASR)在KIParla语料库转录工作流程中的实现情况。KIParla语料库是一个由意大利语录音组成的资源。通过两个阶段的实验,11名专家和初学者转录者分别对相同的音频片段进行手动转录和ASR辅助转录,这些转录结果随后通过统计建模、词级对齐和一系列基于注释的指标进行分析。结果表明,ASR辅助的工作流程可以提高转录速度,但不一致地提高整体准确率,效果取决于多个因素,如工作流程配置、对话类型和注释员的经验水平。将对齐指标、描述性统计和统计建模相结合的分析提供了系统性的框架,用于在不同注释员和工作流程之间监控转录行为。尽管存在局限性,ASR辅助转录, potentially supported by task-specific fine-tuning(以特定任务微调支持),可被整合到KIParla的转录工作流程中,以不牺牲转录质量的前提下加速语料库的创建。
引用
@article{arxiv.2603.16258,
title = {Is Semi-Automatic Transcription Useful in Corpus Creation? Preliminary Considerations on the KIParla Corpus},
author = {Martina Simonotti and Ludovica Pannitto and Eleonora Zucchini and Silvia Ballarè and Caterina Mauri},
journal= {arXiv preprint arXiv:2603.16258},
year = {2026}
}