中文

实时音乐模型

声音 2025-11-06 v3 人机交互 机器学习

摘要

我们提出一种新的生成模型类,称为实时音乐模型(live music models),其能以实时方式产生连续的音乐流并实现与用户同步控制。我们发布了Magenta RealTime,一款开源的实时音乐模型,可通过文本或音频提示控制声学风格。在音乐质量的自动指标上,Magenta RealTime 在其他开源权重音乐生成模型中表现更佳,尽管使用的参数更少且提供了首创的实时生成功能。我们也发布了 Lyria RealTime,一款基于 API 的模型,提供更广泛的控制选项,为用户提供我们最强大的模型及其广泛的提示覆盖。这些模型展示了一种新的 AI 辅助音乐创作范式,强调以人为参与的实时音乐演出。

关键词

引用

@article{arxiv.2508.04651,
  title  = {Live Music Models},
  author = {Lyria Team and Antoine Caillon and Brian McWilliams and Cassie Tarakajian and Ian Simon and Ilaria Manco and Jesse Engel and Noah Constant and Yunpeng Li and Timo I. Denk and Alberto Lalama and Andrea Agostinelli and Cheng-Zhi Anna Huang and Ethan Manilow and George Brower and Hakan Erdogan and Heidi Lei and Itai Rolnick and Ivan Grishchenko and Manu Orsini and Matej Kastelic and Mauricio Zuluaga and Mauro Verzetti and Michael Dooley and Ondrej Skopek and Rafael Ferrer and Savvas Petridis and Zalán Borsos and Äaron van den Oord and Douglas Eck and Eli Collins and Jason Baldridge and Tom Hume and Chris Donahue and Kehang Han and Adam Roberts},
  journal= {arXiv preprint arXiv:2508.04651},
  year   = {2025}
}