
Ściśle trzyma się dostarczonego tekstu piosenki
Wersy, które napisałeś, wracają zaśpiewane tak, jak je napisałeś, zamiast parafraz czy zgubionych linijek — dokładnie to, czego potrzebuje autor z gotowym tekstem.
Multimodalna Projekcja Sztuki
Otwarty model, który naprawdę śpiewa słowa, które mu podasz.
W skrócie
Dane zweryfikowane 2026-08-10. Ten obszar szybko się zmienia — sprawdź ponownie, zanim na nich polegasz.
Trzymanie się tekstu jest trudniejsze, niż brzmi, i tu wiele modeli piosenek po cichu polega: dajesz gotowy tekst, a model śpiewa coś obok, gubi wersy, powtarza inne albo przerabia frazowanie pod melodię, którą woli. YuE jest tu wyjątkowo zdyscyplinowany, dlatego to otwarty wybór dla songwriterów przychodzących z gotowymi słowami. W połączeniu z licencją Apache 2.0 i pełno-rozdzielczym stereofonicznym wyjściem zajmuje naprawdę użyteczną niszę: model do self-hostingu, który szanuje autorski tekst i da się wdrożyć komercyjnie bez negocjacji licencyjnych. Generuje wolniej niż ACE-Step i robi bardziej zachowawcze aranże, więc to nie jest model do szybkiego eksplorowania kierunków. To jest ten, który bierze napisane już słowa i pozwala je wielokrotnie usłyszeć zaśpiewane — bez płacenia za każdą próbę.
Mocne strony

Wersy, które napisałeś, wracają zaśpiewane tak, jak je napisałeś, zamiast parafraz czy zgubionych linijek — dokładnie to, czego potrzebuje autor z gotowym tekstem.

Licencja Apache 2.0 oznacza, że wdrożenie komercyjne to decyzja inżynieryjna, a nie prawna przepychanka.

Pełne stereo 44,1 kHz oznacza materiał w jakości do wydania, a nie coś, co musisz podbijać i tłumaczyć się za to.
Jak wypada w porównaniu
YuE to model generowania piosenek z otwartymi wagami na licencji Apache 2.0, który trzyma się dostarczonego tekstu zamiast go parafrazować i generuje pełne stereo 44,1 kHz.
Porównaj z MusicGenerate
Wyszukiwane jako yue, yue ai music, yue model i open source song generator. Ścisłe trzymanie się tekstu to cecha, dla której przychodzą tu autorzy piosenek.
Bardziej dosłownie niż większość. Trzymanie się tekstu to miejsce, gdzie wiele modeli piosenek po cichu polega — gubią wersy, powtarzają inne, zmieniają frazowanie — a YuE jest tu wyjątkowo zdyscyplinowany: śpiewa to, co napisałeś.
Apache 2.0 na wagach, z pozwoleniem na użycie komercyjne i modyfikację. Jak przy każdym otwartym modelu, to dotyczy wag i nie rozwiązuje pytań o dane treningowe.
Pełne stereo 44,1 kHz, więc wynik ma jakość do wydania, a nie coś, co musisz podbijać.
Wolniejszy niż ACE-Step, z bardziej zachowawczymi aranżami. To model do wielokrotnego słuchania gotowych słów zaśpiewanych bez płacenia za każdą próbę, nie do szybkiego eksplorowania kierunków.
Wagi są darmowe na licencji Apache 2.0, która też pozwala na użycie komercyjne — najjaśniejsza sytuacja licencyjna wśród otwartych modeli piosenek obok ACE-Step.
Wolniej niż ACE-Step i DiffRhythm. To model do wielokrotnego słuchania gotowych słów zaśpiewanych, a nie do szybkiego sprawdzania kierunków.
Eksploruj dalej
Więcej modeli
Modele i platformy, które śledzimy, porównane pod kątem możliwości i licencji.