中文

量子增强的人声演唱分析与评估

音频与语音处理 2025-09-03 v1 声音

摘要

我们提出了 QuantumMelody,一种混合量子-经典方法,用于客观人声演唱评估。将人声特征(音高稳定性、动态范围、音色)分组编码到小型模拟量子电路中;对电路中的所有 9 个量子比特施加 Hadamard 门初始化,然后依次接收 Rx、Ry、Rz 旋转,以及在量子比特之间进行的 intra- 和 cross-group 纠缠。将电路测量概率与声谱变换器嵌入向量融合,以估计标签为 2-5 的成绩,并揭示技术层面的反馈。在 168 份标注好的 20 秒片段上,该混合方法与专家评分员的一致性达到 74.29%,比经典特征基线提高了 12.86 分。处理时间仅为每段录音不到 1 分钟,采用笔记本级 Qiskit 模拟器;我们不声称硬件层面的加速。这一步是为可解释的、客观的人声评估奠定可行性,服务于应用音频信号处理领域。

关键词

引用

@article{arxiv.2509.00106,
  title  = {Quantum-Enhanced Analysis and Grading of Vocal Performance},
  author = {Rohan Agarwal},
  journal= {arXiv preprint arXiv:2509.00106},
  year   = {2025}
}

备注

4 pages, 5 figures. Hybrid quantum - classical feasibility study; simulator - only results