中文

BREATH:基于生物雷达的人类感知扩散音乐生成器

人机交互 2025-10-21 v1 人工智能 声音

摘要

我们提出了一种集成生理感知、LLM推理和可控音频合成的多模态个性化音乐生成系统。毫米波雷达传感器非侵入式地捕获心率和呼吸率。这些生理信号结合环境状态,由推理智能体解释,以推断象征性音乐描述符,如节拍、情绪强度和传统中国五声调模式,然后作为结构化提示传递给基于扩散的音频模型,以合成富有表现力的旋律。该系统通过调性嵌入强调了文化 grounding,实现了自适应、具身的音乐交互。为评估该系统,我们采用研究-创作方法结合案例研究、专家反馈和针对性控制实验。结果表明,生理变化可以有意义的方式调制音乐特征,调性条件可增强与意图模式特征的一致性。专家用户报告称,该系统提供了直观、文化共鸣的音乐响应,并强调其在治疗和交互应用中的潜力。本工作展示了将雷达感知、提示推理和生成音频建模联系起来的新的生物音乐反馈环路。

关键词

引用

@article{arxiv.2510.15895,
  title  = {BREATH: A Bio-Radar Embodied Agent for Tonal and Human-Aware Diffusion Music Generation},
  author = {Yunzhe Wang and Xinyu Tang and Zhixun Huang and Xiaolong Yue and Yuxin Zeng},
  journal= {arXiv preprint arXiv:2510.15895},
  year   = {2025}
}

备注

Accepted by LLM4Music @ ISMIR 2025