中文

pyAMPACT:基于得分-音频对齐的表演数据估计与多模态处理工具包

声音 2026-01-06 v2 多媒体 音频与语音处理

摘要

pyAMPACT(Python 基于自动音乐演出分析与比较工具包)将符号化音乐表示与音频表示进行关联,旨在实现基于谱面(score)的音频中表演数据的估计,以及一般性地将符号化音乐表示与音频表示进行多种注释的关联。pyAMPACT 能够读取多种符号化格式,并输出以 MEI 格式的文件中与音符关联的音频描述符/表演数据。音频分析采用谱面对齐计算每个音符在时频域中的重要区域,以估计一系列参数,包括调音、动态和风格相关的表演描述符,以及来自谱面对齐的时序信息。除表演数据估计外,pyAMPACT 还通过其将符号化表示与注释关联到音频的基础设施,促进了多模态调查。

关键词

引用

@article{arxiv.2412.05436,
  title  = {pyAMPACT: A Score-Audio Alignment Toolkit for Performance Data Estimation and Multi-modal Processing},
  author = {Johanna Devaney and Daniel McKemie and Alex Morgan},
  journal= {arXiv preprint arXiv:2412.05436},
  year   = {2026}
}

备注

Proceedings of the 2025 International Computer Music Conference