
对提供的歌词贴合度高
你写的句子会按原样被唱出来,不会被意译或漏掉,这正是带着定稿歌词的创作者需要的。
多模态艺术投影
真正按你给的词来唱的开源模型。
一句话
数据已核实 2026-08-10。 这个领域变化很快——在依赖它们前请再核对一遍。
按词唱比听起来难,很多歌曲模型都会悄悄掉链子:你给了定稿歌词,它却唱得似是而非,漏句、重复,或者为了它偏好的旋律硬改你的措辞。YuE 在这点上格外自律,这让它成了带着成稿来的人最合适的开源模型。再加上 Apache 2.0 许可和全分辨率立体声输出,它占了一个真正有用的位置:可自托管、尊重作者歌词、而且能不谈判就商用的模型。生成比 ACE-Step 慢,编配也更保守,所以它不适合快节奏地试方向。它适合把你已经写好的词反复唱出来,而且不用为每次尝试付费。
长处

你写的句子会按原样被唱出来,不会被意译或漏掉,这正是带着定稿歌词的创作者需要的。

用 Apache 2.0 许可,商用部署就是工程决策,不是法律拉扯。

完整 44.1 kHz 立体声输出,成品就是发行级分辨率,不用升采样再道歉。
怎么比

常被搜作 yue、yue ai music、yue model 和 open source song generator。对歌词的贴合度(lyric adherence)是把词曲作者特地吸引过来的关键。
比多数模型更贴字。按词唱是很多歌曲模型的暗坑——漏句、重复、改措辞——而 YuE 在照你所写去唱这点上很自律。
权重用 Apache 2.0,允许商用和修改。和所有开源模型一样,它管的是权重,不解决训练数据的问题。
完整 44.1 kHz 立体声,成品是发行级分辨率,不用再去升采样。
比 ACE-Step 慢,编配也更保守。它用来反复把定稿的词唱出来且不用为每次付费,不是用来快速试方向的。
权重在 Apache 2.0 下免费,也允许商用——和 ACE-Step 一样,是开源歌曲模型里最清晰的许可立场。
比 ACE-Step 和 DiffRhythm 慢。它是用来反复把定稿的词唱出来的,不是用来快速试方向的。