audio2chart:从原始音频生成可播放的 Guitar Hero 图表的端到端框架
音频与语音处理
2025-11-06 v1 声音
摘要
本工作引入了 audio2chart 框架,用于从原始音频自动生成 Guitar Hero 风格的图表。将该任务形式化为序列预测问题,训练模型在离散时间步上生成与音频对齐的离散图表标记。无条件基线模型表现出强大的预测性能,加入音频条件后在基于准确性的指标上 consistently 获得改进。本工作表明, incorporating 音频条件既是可行的也是提高自动图表生成中 note 预测效果的有效方法。完整的代码库已公开于 GitHub,支持神经图表生成的可重复科研。随发布的一系列预训练模型可在 Hugging Face 上获取。
关键词
引用
@article{arxiv.2511.03337,
title = {audio2chart: End to End Audio Transcription into playable Guitar Hero charts},
author = {Riccardo Tripodi},
journal= {arXiv preprint arXiv:2511.03337},
year = {2025}
}