摘要
本发明提供一种音乐生成方法、装置、电子设备及存储介质,涉及音乐生成技术领域,该方法采用FocalCodec模型的编码结构对第一样本音乐数据进行处理得到样本音乐词元,进而通过样本音乐词元训练得到自回归模型,由于FocalCodec模型具有低比特率编码能力,可以使得自回归模型能够在极少样本音乐词元下生成高质量的音乐片段,显著减少了计算和存储成本。而且,FocalCodec模型通过二进制码本设计,显著提高了词元利用率,减少了冗余词元的使用,提升了后续生成音乐片段的质量和效率。通过自回归模型和音频超分辨率模型,能够有效地学习音乐的长程依赖关系,生成结构连贯的长音乐片段。