
Canzoni complete con voci
Modelli che scrivono, arrangiano ed eseguono in un solo passaggio — la categoria che la maggior parte intende per “musica AI”.
Il modello musicale migliore cambia ogni poche settimane, quindi restare bloccato su uno solo è una brutta posizione. Questi sono i 28 modelli che seguiamo: in cosa ciascuno è davvero forte, dove cade, e cosa la sua licenza ti permette di fare con l’output.
Due dei modelli open più noti non possono essere usati per fare nulla che tu venda. MusicGen è CC BY-NC — la restrizione si applica all’output, quindi auto-ospitarlo non cambia nulla — e Stable Audio Open arriva con una licenza community che non è una concessione commerciale generale. I team lo scoprono tardi, dopo averci costruito sopra. ACE-Step e YuE sono Apache 2.0, che è un’altra situazione. Licenza del modello e provenienza dei dati di training sono questioni separate, e nulla di questo è consulenza legale.

Il benchmark della voce con cui si misura ogni altro modello di canzone.
Weights: see page
Testo, melodia, arrangiamento e un'esecuzione cantata in un colpo solo.
Suno
Il benchmark della voce con cui si misura ogni altro modello di canzone.
Udio
Il modello di canzone che ti lascia continuare a editare dopo la prima prova.
Google DeepMind
Il modello per brani di DeepMind, distribuito tramite Google invece che venduto direttamente.
ElevenLabs
Il modello di canzone che ti fa specificare la struttura prima di scrivere.
MiniMax
Canzoni complete a una frazione del costo per generazione del livello premium.
MiniMax
Condizionamento dello stile da una clip di riferimento invece che da una descrizione testuale.
MiniMax
Il modello da bozza — abbastanza veloce ed economico per pensare a voce alta.
Kunlun Tech
Generazione di canzoni API-first con una cadenza di release insolitamente veloce.
Riffusion
L'esperimento sugli spettrogrammi che è diventato una piattaforma per canzoni.
Musica senza voci — bed, loop, texture ed effetti.
Modelli scaricabili che puoi auto-ospitare. Le condizioni di licenza variano parecchio.
ACE Studio & StepFun
Il modello per canzoni a pesi aperti con una licenza su cui puoi davvero costruire un business.
Proiezione artistica multimodale
Il modello open che canta davvero le parole che gli dai.
ASLP Lab
Canzoni a lunghezza piena generate in una frazione del tempo normale.
Stability AI
Il modello open con un training set che può davvero elencare.
Meta AI
Canticchia un’idea e ottieni un arrangiamento — il modello originale con conditioning sulla melodia.
Meta AI
Il modello veloce di Meta — stessa qualità senza l'attesa sequenziale.
Dividere un mix finito di nuovo in stem.
Strumenti per utenti e creator costruiti sopra modelli di generazione.
Musicfy
Una piattaforma per la trasformazione della voce, non un generatore di canzoni.
Soundful
Tracce basate su template per creator che vogliono il prevedibile, non le sorprese.
Loudly
Generazione più una libreria, per quando la sola generazione non basta.
Soundraw
Modifica l’arrangiamento sezione per sezione invece di rigenerare.
Boomy
La via più breve dal nulla a una traccia su una piattaforma di streaming.
Mubert
Musica continua, che non si ripete mai, pensata per essere incorporata.
AIVA Technologies
Quello che ti dà MIDI invece di un file finito.
LALAL.AI
Separazione degli stem per chi non vuole installare niente.
MusicGenerate è fatta per instradare tra modelli, non per puntare su uno solo. Il catalogo qui sopra è ciò che seguiamo e valutiamo; quali modelli sono collegati al prodotto in un dato momento è un’altra questione, e la risposta cambia insieme al settore. I numeri su ogni pagina riportano la data di verifica, perché un benchmark in questa categoria diventa vecchio in un trimestre.
Dentro
Confrontati per cosa producono, quanto li puoi guidare e cosa permette la licenza.

Modelli che scrivono, arrangiano ed eseguono in un solo passaggio — la categoria che la maggior parte intende per “musica AI”.
1 / 5
Perché esiste
La qualità si sente subito. Sono i termini a decidere se puoi pubblicare.
Genera musica gratisDue modelli possono suonare uguali e differire del tutto nel se puoi pubblicare il risultato. Questa è la prima domanda, non l’ultima.
Un modello scaricabile può comunque avere una clausola non commerciale. Il self-hosting non cambia cosa permette la licenza.
Ogni scheda riporta la data dell’ultima verifica, perché una pagina che sembra aggiornata e non lo è è peggio di una che ammette la sua età.
Una pagina di modello senza sezione limiti è una brochure. I limiti sono la parte che la gente cerca.
Per chi è
Sfoglia
Dipende dal lavoro. Suno guida sul realismo delle voci, Udio sul montaggio post-generazione, ElevenLabs sul controllo strutturale, Stable Audio sulla texture strumentale e sul self-hosting, e AIVA sul MIDI modificabile.
Stable Audio Open, ACE-Step, YuE, MusicGen, MAGNeT e DiffRhythm forniscono tutti pesi open. Le loro licenze differiscono parecchio — ACE-Step e YuE sono Apache 2.0, mentre altri restringono la distribuzione commerciale.
Un modello è il sistema che genera audio; una piattaforma è il prodotto costruito attorno a un modello. Suno e Udio sono piattaforme con modelli chiusi; MusicGen è un modello che puoi eseguire da solo.
Solo alcuni. I modelli Apache 2.0 lo permettono in modo esplicito; diverse licenze di ricerca no. La licenza copre i pesi e non dice nulla sui dati su cui sono stati addestrati, che è un rischio a parte.
Suno v5 al momento fa da riferimento — respiro, vibrato e fraseggio dinamico sono eseguiti, non approssimati, ed è il vantaggio più netto che qualsiasi modello in questa directory abbia.
Ogni voce riporta la data dell’ultima verifica. Il settore si muove in fretta, quindi considera qualunque specifica più vecchia di qualche mese come da ricontrollare presso il fornitore.
Descrivi cosa vuoi — decidiamo noi quale modello far girare.