arrow
返回

Second-order wavelet-based multi-frequency music generation

delete2025-09-05
delete0
PRE
AI
K
Kun Bai *
J
Jiayu Zhang
DOI:10.1007/s11760-025-04146-zdelete
delete原文链接
delete原文求助
delete分享
delete收藏
摘要

摘要

En 中文
得益于人工智能算法的进步,音乐生成在质量和时长方面均取得了显著进展。目前,基于人类文本提示生成的音乐在连续性和旋律方面能够获得较高的偏好度。然而,大多数研究忽视了旋律(高低频率)在音乐生成中的重要性。事实上,当前基于扩散的音乐生成模型的输出倾向于平均概率,导致模型难以有效生成或处理高低频信号。在本文中,我们构建了一个二阶小波自动编码器,用于将波形分解为低频和高频分量。随后,我们使用扩散模型(DM)对不同的频率信号进行建模。此外,我们提出一个频域感知模块,以增强DM在不同时间步处理频率的能力。与最先进的工作相比,在生成质量和时长相似条件下,我们的方法在偏好度上表现更优。
Keyword:
Music generation
Diffusion model
Second-order wavelet
Autoencoder

期刊

Signal Image and Video Processing 封面图
Signal Image and Video Processing
IF:
2.1
论文数:
908
被引数:
4.6K

机构

暂无机构信息
引用论文

引用论文

Bengali Music Genre Classification Using WaveNet
err2023-12-13
err0
PREAI
errKhan,Md. Nabil Rahman; Tuli,Khandaker Iffat Jahan; Salsabil,Most. Sadia; Reza,S.M. Raiyan; Shah,Faisal Muhammad; Joy,Sajib Kumar Saha
err分享
err收藏
NetDiffus: Network traffic generation by diffusion models through time-series imagingNetDiffus: 通过时间序列成像通过扩散模型生成网络流量
err2024-09-01
err0
errOAAI
errNirhoshan Sivaroopan; Dumindu Bandara; Chamara Madarasingha; Guillaume Jourjon; Anura P. Jayasumana; Kanchana Thilakarathna
err分享
err收藏
A review of intelligent music generation systems智能音乐生成系统综述
err2024-02-19
err0
PREAI
errLei Wang; Ziyi Zhao; Hanwei Liu; Junwei Pang; Yi Qin; Qidi Wu
err分享
err收藏
err分享
err收藏
学者 查看更多内容