开源音乐生成模型YuE2近日登上GitHub Trending榜首,Star数突破一万,其SongBench均分已进入Suno v5/v6、Mureka 9等商业模型所在区间。针对原版流水线一次只能处理一首歌、模型在任务间反复加载卸载的瓶颈,NoizAI团队开源了首个推理加速方案YuE2-Turbo。该方案未更换模型、未改动采样规格,权重仍为YuE2-3B,精度保持BF16,保留原32步flow-matching,主要做了三项优化:自回归阶段引入vLLM调度,使多首歌的AR生成可并行推进;MoT与VAE模块全程常驻显存,避免任务间来回迁移;非自回归的声学合成阶段支持跨请求批处理,并实现流水线并行,即上一批歌曲进行NAR/VAE解码时,下一批的AR阶段可提前启动。在RTX 5090(32GB)上实测,单首歌RTF从0.290降至0.173,加速1.68倍;4路并发场景下RTF从0.317降至0.096,加速3.31倍,一首一分多钟的歌曲约10秒即可生成。YuE2作为白盒音乐模型,生成歌曲前会先输出ABC乐谱,用户可自由编辑和弦、旋律、节拍、歌词后重新渲染;翻唱功能借助SheetSage2将旋律转为乐谱,在SHS100K数据集948首作品上达到71.3%的Hit@1。项目代码已在GitHub开源,接受社区贡献。
事件分析
核心观点:AI音乐生成的竞争正从模型能力转向推理工程,开源阵营用消费级硬件跑通落地,是打破Suno闭源垄断的关键一步。
原文链接:Linux.do

评论前必须登录!
立即登录 注册