
Pełne piosenki z wokalem
Modele, które piszą, aranżują i wykonują w jednym przebiegu — to zwykle ludzie mają na myśli, mówiąc „AI music”.
Najlepszy model muzyczny zmienia się co kilka tygodni, więc bycie przywiązanym do jednego to kiepska sytuacja. Oto 28 modele, które śledzimy — w czym każdy naprawdę jest dobry, gdzie się wykłada i co jego licencja pozwala Ci zrobić z wynikiem.
Dwa z najbardziej znanych otwartych modeli nie wolno używać do tworzenia czegokolwiek na sprzedaż. MusicGen ma CC BY-NC — ograniczenie dotyczy wyniku, więc samodzielny hosting nic tu nie zmienia — a Stable Audio Open jest udostępniany na licencji społecznościowej, która nie jest ogólną zgodą komercyjną. Zespoły dowiadują się o tym za późno, już po zbudowaniu na nich. ACE-Step i YuE mają Apache 2.0, co jest inną sytuacją. Licencja modelu i pochodzenie danych treningowych to osobne sprawy — i nic z tego nie jest poradą prawną.

Wokalny punkt odniesienia, względem którego mierzy się każdy inny model piosenek.
Weights: see page
Tekst, melodia, aranż i zaśpiewany wokal w jednym przebiegu.
Suno
Wokalny punkt odniesienia, względem którego mierzy się każdy inny model piosenek.
Udio
Model piosenek, który pozwala dalej edytować po pierwszym podejściu.
Google DeepMind
Model piosenek DeepMind, dystrybuowany przez Google zamiast sprzedawany bezpośrednio.
ElevenLabs
Model do piosenek, w którym ustawiasz strukturę, zanim zacznie pisać.
MiniMax
Pełne piosenki za ułamek kosztu za generację w segmencie premium.
MiniMax
Warunkowanie stylu z klipu referencyjnego zamiast opisu tekstowego.
MiniMax
Model roboczy — wystarczająco szybki i tani, by myśleć na głos.
Kunlun Tech
Generowanie piosenek w trybie API-first z niezwykle szybkim tempem wydań.
Riffusion
Eksperyment ze spektrogramami, który zamienił się w platformę do piosenek.
Muzyka bez wokali — podkłady, loopy, tekstury i efekty.
Modele do pobrania, które możesz hostować u siebie. Warunki licencji mocno się różnią.
ACE Studio & StepFun
Otwarty model piosenek z licencją, na której faktycznie zbudujesz biznes.
Multimodalna Projekcja Sztuki
Otwarty model, który naprawdę śpiewa słowa, które mu podasz.
ASLP Lab
Piosenki pełnej długości generowane w ułamku zwykłego czasu.
Stability AI
Otwarty model z zbiorem treningowym, który faktycznie potrafi nazwać.
Meta AI
Zanuć pomysł i dostaniesz aranżację — oryginalny model warunkowany melodią.
Meta AI
Szybki model Meta — ta sama jakość bez sekwencyjnego czekania.
Rozbijanie gotowego miksu z powrotem na stemy.
Narzędzia dla konsumentów i twórców zbudowane na modelach generatywnych.
Musicfy
Platforma do transformacji wokali, a nie generator piosenek.
Soundful
Utwory oparte na szablonach dla twórców, którzy wolą przewidywalność zamiast niespodzianek.
Loudly
Generowanie plus biblioteka — na sytuacje, gdy samo generowanie nie dowozi.
Soundraw
Edytuj aranżację sekcja po sekcji zamiast regenerować.
Boomy
Najkrótsza droga od zera do tracka na serwisach streamingowych.
Mubert
Ciągła, nigdy się nie powtarzająca muzyka, stworzona do osadzania.
AIVA Technologies
To, które daje Ci MIDI zamiast gotowego pliku.
LALAL.AI
Separacja stemów dla tych, którzy nie chcą nic instalować.
MusicGenerate jest zbudowane po to, żeby routować między modelami, a nie stawiać na jeden. Katalog powyżej to to, co śledzimy i oceniamy; które modele są w danym momencie podłączone do produktu, to osobna sprawa — i zmienia się tak, jak zmienia się cały obszar. Liczby na każdej stronie mają datę weryfikacji, bo benchmark w tej kategorii starzeje się w kwartał.
W środku
Porównane po tym, co wypuszczają, jak bardzo możesz sterować, i na co pozwala licencja.

Modele, które piszą, aranżują i wykonują w jednym przebiegu — to zwykle ludzie mają na myśli, mówiąc „AI music”.
1 / 5
Po co to jest
Jakość efektu słychać od razu. To warunki decydują, czy w ogóle możesz to wypuścić.
Generuj muzykę za darmoDwa modele mogą brzmieć podobnie, a całkiem się różnić co do tego, czy wolno ci opublikować wynik. To pierwsze pytanie, nie ostatnie.
Model do pobrania nadal może mieć klauzulę non-commercial. Self-hosting nie zmienia tego, na co pozwala licencja.
Każdy wpis ma datę weryfikacji faktów, bo strona, która wygląda na aktualną, a nie jest, jest gorsza niż taka, która przyznaje się do wieku.
Strona modelu bez sekcji ograniczeń to broszurka. To właśnie limity ludzie szukają.
Dla kogo to jest
Przeglądaj
To zależy od zadania. Suno prowadzi w realizmie wokalu, Udio w edycji po generowaniu, ElevenLabs w kontroli struktury, Stable Audio w fakturze instrumentalnej i self-hostingu, a AIVA w edytowalnym MIDI.
Stable Audio Open, ACE-Step, YuE, MusicGen, MAGNeT i DiffRhythm mają otwarte wagi. Ich licencje mocno się różnią — ACE-Step i YuE są na Apache 2.0, podczas gdy inne ograniczają komercyjne wdrożenie.
Model to system, który generuje audio; platforma to produkt zbudowany wokół niego. Suno i Udio to platformy z zamkniętymi modelami; MusicGen to model, który możesz uruchomić sam.
Tylko niektóre. Modele na Apache 2.0 pozwalają na to wprost; kilka licencji badawczych — nie. Licencja obejmuje wagi i nie mówi nic o danych, na których trenowano model — to osobne ryzyko.
Suno v5 wyznacza obecnie punkt odniesienia — oddech, vibrato i dynamiczne frazowanie są wykonane, nie przybliżone, i to najczytelniejsza pojedyncza przewaga jakiegokolwiek modelu w tym katalogu.
Każda pozycja ma datę ostatniej weryfikacji faktów. Branża pędzi, więc wszystko starsze niż parę miesięcy warto sprawdzić ponownie u dostawcy.