
Точно следует предоставленному тексту песни
Ваши строки возвращаются спетыми как написано, а не пересказанными и не выброшенными — ровно то, что нужно автору с готовым текстом.
Мультимодальная проекция искусства
Открытая модель, которая действительно поёт данные вами слова.
Коротко
Цифры проверены 2026-08-10. Эта область меняется быстро — перепроверьте, прежде чем на них полагаться.
Приверженность тексту — задача сложнее, чем кажется, и тут многие песенные модели тихо проваливаются: вы даёте готовый текст, а модель поёт что-то рядом, выкидывая строки, повторяя другие или перекраивая фразы под мелодию, которая ей по душе. YuE на редкость дисциплинирована, поэтому это открытая модель по выбору для авторов, приходящих с готовыми словами. В сочетании с лицензией Apache 2.0 и полноразрешённым стереовыводом она занимает по-настоящему полезную нишу: самохостимая модель, уважающая авторский текст и готовая к коммерческому развёртыванию без лицензионных переговоров. Генерация медленнее, чем у ACE-Step, а аранжировки более консервативные, так что это не модель для быстрых разведок направлений. Это модель, чтобы снова и снова слышать уже написанные вами слова, и не платить за каждую попытку.
Сильные стороны

Ваши строки возвращаются спетыми как написано, а не пересказанными и не выброшенными — ровно то, что нужно автору с готовым текстом.

Лицензия Apache 2.0 означает, что коммерческое развёртывание — это инженерное решение, а не юридические торги.

Полный стереовывод 44.1 kHz означает релизное разрешение, а не что-то, что придётся апсемплить и извиняться.
Как это выглядит в сравнении
YuE — открытая по весам песенная модель с лицензией Apache 2.0. Она следует данному листу текста близко, а не пересказывает его, и выдаёт полноценный стереовывод 44.1 kHz.
Сравнить с MusicGenerate
Ищут как yue, yue ai music, yue model и open source генератор песен. Приверженность тексту — это свойство, ради которого к нему приходят авторы.
Буквальнее, чем большинство. Приверженность тексту — место, где многие песенные модели тихо проваливаются (выкидывают строки, повторяют другие, перекраивают фразы), а YuE заметно дисциплинирована в том, чтобы петь то, что вы написали.
Apache 2.0 на веса, допускает коммерческое использование и модификацию. Как и с любой открытой моделью, это регулирует веса и само по себе не решает вопросы об обучающих данных.
Полный стереовывод 44.1 kHz, то есть результат релизного разрешения, а не что-то, что придётся апсемплить.
Медленнее ACE-Step, с более консервативными аранжировками. Это модель, чтобы многократно слышать уже готовые слова без платы за каждую попытку, а не для быстрых разведок направлений.
Веса бесплатны по Apache 2.0, которая также допускает коммерческое использование — самый понятный лицензионный режим среди открытых песенных моделей наряду с ACE-Step.
Медленнее ACE-Step и DiffRhythm. Это модель, чтобы многократно слышать уже готовые слова, а не для быстрых разведок направлений.
Продолжайте изучать
Больше моделей
Модели и платформы, за которыми мы следим, — сравнение по возможностям и лицензии.