
Hotové písně s vokály
Modely, které v jednom tahu píší, aranžují a zahrají — to je ta kategorie, kterou většina lidí myslí „AI hudbou“.
Nejlepší hudební model se mění každých pár týdnů, takže být vázaní na jeden je špatná pozice. Tohle jsou 28 modely, které sledujeme — v čem je který doopravdy dobrý, kde selhává a co vám jeho licence dovolí dělat s výsledkem.
Dva z nejznámějších otevřených modelů nesmíte použít k výrobě ničeho, co prodáváte. MusicGen je pod CC BY-NC — omezení se vztahuje na výstup, takže vlastní hostování na tom nic nemění — a Stable Audio Open je dodáván pod komunitní licencí, která není obecnou komerční licencí. Týmy to zjišťují pozdě, až když na nich postaví produkt. ACE-Step a YuE jsou pod Apache 2.0, což je jiná situace. Licence modelu a původ trénovacích dat jsou oddělené otázky a nic z toho není právní rada.

Laťka vokálů, podle které se měří všechny ostatní modely na písně.
Licence: Podle podmínek tarifu Suno
Text, melodie, aranžmá a zazpívaný part na jeden zátah.
Suno
Laťka vokálů, podle které se měří všechny ostatní modely na písně.
Udio
Model písně, který vám umožní dál upravovat i po prvním takeu.
Google DeepMind
Model pro písně od DeepMind, distribuovaný přes Google místo přímého prodeje.
ElevenLabs
Model na písně, který vám dovolí určit strukturu, než začne generovat.
MiniMax
Celé písně za zlomek nákladů na generaci oproti prémiové úrovni.
MiniMax
Řízení stylu podle referenčního audio klipu místo textového popisu.
MiniMax
Náčrtový model — dost rychlý a levný na to, abyste u něj mohli přemýšlet nahlas.
Kunlun Tech
Generování písní s přístupem API-first a neobvykle rychlou kadencí vydání.
Riffusion
Experiment se spektrogramy, který se změnil v platformu pro písně.
Hudba bez vokálů — podklady, smyčky, textury a efekty
Stáhnutelné modely, které si můžete hostovat sami. Licenční podmínky se výrazně liší.
ACE Studio & StepFun
Otevřený model pro songy s licencí, na které můžete skutečně postavit byznys.
Multimodální umělecká projekce
Otevřený model, který skutečně zpívá slova, která mu dáte.
ASLP Lab
Plnohodnotné písně vygenerované za zlomek obvyklého času.
Stability AI
Otevřený model s tréninkovým datasetem, který umí skutečně pojmenovat.
Meta AI
Zahumkejte nápad a nechte si ho zaranžovat — původní model s podmíněním melodií.
Meta AI
Rychlý model od Meta — stejná kvalita bez sekvenčního čekání.
Rozdělení hotového mixu zpět na stemy
Nástroje pro uživatele i tvůrce postavené na generativních modelech
Musicfy
Platforma na transformaci vokálů, ne generátor songů.
Soundful
Tracky řízené šablonami pro tvůrce, kteří chtějí předvídatelné, ne překvapivé.
Loudly
Generování plus knihovna — na situace, kdy samotné generování nestačí.
Soundraw
Upravte aranžmá sekci po sekci místo regenerace.
Boomy
Nejkratší cesta od ničeho k tracku na streamovací službě.
Mubert
Nepřetržitá, neopakující se hudba určená k vložení.
AIVA Technologies
Ten, který vám místo hotového souboru předá MIDI.
LALAL.AI
Separace stemů pro lidi, kteří nechtějí nic instalovat.
MusicGenerate je postavený tak, aby směroval mezi modely, ne sázel na jeden. Katalog výše je to, co sledujeme a hodnotíme; které modely jsou v danou chvíli zapojené do produktu, je jiná otázka a odpověď se mění, jak se mění obor. Čísla na každé stránce nesou datum ověření, protože benchmark v téhle kategorii zastará během čtvrtletí.
Uvnitř
Srovnané podle výstupu, míry ovládání a toho, co dovoluje licence.

Modely, které v jednom tahu píší, aranžují a zahrají — to je ta kategorie, kterou většina lidí myslí „AI hudbou“.
1 / 5
Proč to existuje
Kvalitu výstupu je snadné slyšet. O tom, jestli to můžete vydat, ve skutečnosti rozhodují podmínky.
Generujte hudbu zdarmaDva modely mohou znít podobně a úplně se lišit v tom, jestli výsledek smíte publikovat. To je první otázka, ne poslední.
Stáhnutelný model může pořád nést doložku „jen nekomerčně“. Self-hosting nemění to, co licence povoluje.
Každá položka nese datum poslední kontroly faktů, protože stránka, která vypadá aktuálně a není, je horší než ta, která přizná svůj věk.
Stránka modelu bez sekce omezení je prospekt. Limity jsou to, co lidé hledají.
Procházet
Záleží na úkolu. Suno vede v realističnosti vokálů, Udio v editaci po generování, ElevenLabs ve strukturální kontrole, Stable Audio v instrumentální textuře a self-hostingu a AIVA v editovatelném MIDI.
Stable Audio Open, ACE-Step, YuE, MusicGen, MAGNeT a DiffRhythm mají otevřené váhy. Jejich licence se výrazně liší — ACE-Step a YuE jsou Apache 2.0, zatímco ostatní omezují komerční nasazení.
Model je systém, který generuje audio; platforma je produkt, který ho obaluje. Suno a Udio jsou platformy s uzavřenými modely; MusicGen je model, který si můžete spustit sami.
Jen některé. Modely pod Apache 2.0 ho dovolují přímo; několik výzkumných licencí ne. Licence pokrývá váhy a neříká nic o datech, na kterých byly trénované — to je samostatné riziko.
Suno v5 aktuálně nastavuje laťku — dech, vibrato a dynamické frázování jsou provedené, ne jen přibližené, a je to nejzřetelnější jednotlivá výhoda, kterou má kterýkoli model v tomhle adresáři.
Každá položka nese datum posledního ověření faktů. Obor se hýbe rychle, takže cokoli starší než pár měsíců berte jako věc k ověření u dodavatele.