
Músicas completas com vocais
Modelos que escrevem, arranjam e executam de uma vez só — a categoria que a maioria quer dizer quando fala em "música com IA".
O melhor modelo de música muda a cada poucas semanas, então ficar preso a um é uma má posição. Estes são os 28 modelos que acompanhamos — no que cada um é realmente bom, onde ele falha e o que sua licença permite que você faça com o resultado.
Dois dos modelos abertos mais conhecidos não podem ser usados para fazer algo que você venda. MusicGen é CC BY-NC — a restrição se aplica ao resultado, então hospedar por conta própria não muda nada — e Stable Audio Open vem com uma licença comunitária que não é uma permissão comercial geral. As equipes descobrem isso tarde, depois de construírem em cima deles. ACE-Step e YuE são Apache 2.0, o que é outra situação. Licença do modelo e procedência dos dados de treino são questões separadas, e nada disso é aconselhamento jurídico.

A referência de vocais pela qual todo outro modelo de música é medido.
Weights: see page
Letra, melodia, arranjo e uma performance cantada de uma vez só.
Suno
A referência de vocais pela qual todo outro modelo de música é medido.
Udio
O modelo de música que deixa você continuar editando depois da primeira tomada.
Google DeepMind
Modelo de música da DeepMind, distribuído pelo Google em vez de vendido diretamente.
ElevenLabs
O modelo de song que deixa você definir a estrutura antes de escrever.
MiniMax
Músicas completas por uma fração do custo por geração do nível premium.
MiniMax
Condicionamento de estilo a partir de um clipe de referência, não de uma descrição em texto.
MiniMax
O modelo de rascunho — rápido e barato o bastante pra pensar em voz alta.
Kunlun Tech
Geração de músicas com foco em API, com uma cadência de lançamentos incomumente rápida.
Riffusion
O experimento de espectrograma que virou uma plataforma de músicas.
Música sem vocais — beds, loops, texturas e efeitos.
Modelos para baixar e hospedar por conta própria. Os termos de licença variam bastante.
ACE Studio & StepFun
O modelo de música aberto com uma licença em que você realmente pode construir um negócio.
Projeção de Arte Multimodal
O modelo aberto que de fato canta as palavras que você deu.
ASLP Lab
Músicas de duração completa geradas em uma fração do tempo usual.
Stability AI
O modelo aberto com um conjunto de treinamento que ele realmente pode nomear.
Meta AI
Cantarole uma ideia e receba um arranjo — o modelo original condicionado por melodia.
Meta AI
O modelo rápido da Meta — a mesma qualidade sem a espera sequencial.
Dividir uma mix final de volta em stems.
Ferramentas para consumidores e criadores construídas em cima de modelos de geração.
Musicfy
Uma plataforma de transformação vocal e não um gerador de músicas.
Soundful
Tracks guiados por template para criadores que querem o previsível, não o surpreendente.
Loudly
Geração mais uma biblioteca, para quando só gerar não resolve.
Soundraw
Edite o arranjo seção por seção em vez de regenerar.
Boomy
O caminho mais curto do nada até uma faixa em um serviço de streaming.
Mubert
Música contínua, que nunca se repete, feita para ser incorporada.
AIVA Technologies
A que te entrega MIDI em vez de um arquivo finalizado.
LALAL.AI
Separação de stems para quem não quer instalar nada.
A MusicGenerate é feita para comutar entre modelos em vez de apostar em um só. O catálogo acima é o que a gente acompanha e avalia; quais modelos estão ligados ao produto em qualquer momento é outra questão, e a resposta muda conforme o campo muda. As figuras em cada página trazem a data em que foram verificadas, porque um benchmark nessa categoria fica velho em um trimestre.
Por dentro
Comparados pelo que entregam, pelo quanto você consegue direcionar, e pelo que a licença permite.

Modelos que escrevem, arranjam e executam de uma vez só — a categoria que a maioria quer dizer quando fala em "música com IA".
1 / 5
Por que isso existe
A qualidade do resultado é fácil de ouvir. Os termos é que decidem de verdade se você pode lançar.
Gere música de graçaDois modelos podem soar parecidos e diferir totalmente em se você pode publicar o resultado. Essa é a primeira pergunta, não a última.
Um modelo baixável ainda pode trazer uma cláusula de não comercial. Rodar por conta própria não muda o que a licença permite.
Cada entrada traz a data em que os fatos foram conferidos, porque uma página que parece atual e não é é pior que uma que assume a idade.
Uma página de modelo sem seção de limitações é folheto. Os limites são a parte que as pessoas procuram.
Pra quem é
Explorar
Depende do trabalho. Suno lidera em realismo de vocais, Udio em edição após a geração, ElevenLabs em controle estrutural, Stable Audio em textura instrumental e self-hosting, e AIVA em MIDI editável.
Stable Audio Open, ACE-Step, YuE, MusicGen, MAGNeT e DiffRhythm todos disponibilizam pesos abertos. As licenças diferem bastante — ACE-Step e YuE são Apache 2.0, enquanto outros restringem a implantação comercial.
Um modelo é o sistema que gera áudio; uma plataforma é o produto em volta dele. Suno e Udio são plataformas com modelos fechados; MusicGen é um modelo que você pode rodar por conta própria.
Só alguns. Modelos Apache 2.0 permitem isso de cara; várias licenças de pesquisa não permitem. A licença cobre os pesos e não diz nada sobre os dados em que foram treinados, o que é um risco à parte.
Suno v5 atualmente define a referência — respiração, vibrato e fraseado dinâmico são executados e não apenas aproximados, e é a vantagem mais clara e única que qualquer modelo neste diretório tem.
Cada entrada traz a data em que seus fatos foram verificados por último. O setor anda rápido, então trate qualquer especificação com mais de alguns meses como algo a conferir de novo com o fornecedor.
Descreva o que você quer — a gente escolhe qual modelo roda.