
Canciones completas con voces
Modelos que escriben, arreglan e interpretan en una sola pasada — la categoría a la que la mayoría se refiere por “música con IA”.
El mejor modelo de música cambia cada pocas semanas, así que quedar atado a uno es una mala posición. Estos son los 28 modelos que seguimos: en qué es realmente bueno cada uno, dónde falla y qué te permite hacer su licencia con la salida.
Dos de los modelos abiertos más conocidos no pueden usarse para hacer nada que vendas. MusicGen es CC BY-NC — la restricción se aplica a la salida, así que alojarlo tú no cambia nada — y Stable Audio Open se entrega bajo una licencia comunitaria que no es una concesión comercial general. Muchos equipos se enteran tarde, después de haber construido encima. ACE-Step y YuE son Apache 2.0, que es otra situación. La licencia del modelo y el origen de los datos de entrenamiento son preguntas distintas, y nada de esto es asesoría legal.

El referente de vocals con el que se mide cualquier otro modelo de song.
Weights: see page
Letra, melodía, arreglo y una interpretación cantada en una sola pasada.
Suno
El referente de vocals con el que se mide cualquier otro modelo de song.
Udio
El modelo de canciones que te deja seguir editando después de la primera toma.
Google DeepMind
El modelo de canción de DeepMind, distribuido a través de Google en vez de venderse directamente.
ElevenLabs
El modelo de canción que te deja especificar la estructura antes de generar.
MiniMax
Canciones completas a una fracción del costo por generación del nivel premium.
MiniMax
Condicionamiento de estilo a partir de un clip de referencia en lugar de una descripción en texto.
MiniMax
El modelo de borrador: lo bastante rápido y barato como para pensar en voz alta.
Kunlun Tech
Generación de canciones API-first con una cadencia de lanzamientos inusualmente rápida.
Riffusion
El experimento de espectrogramas que se convirtió en una plataforma de canciones.
Música sin voces — beds, loops, texturas y efectos.
Modelos descargables que puedes alojar tú mismo. Las condiciones de licencia varían mucho.
ACE Studio & StepFun
El modelo abierto de song con una licencia con la que de verdad puedes montar un negocio.
Proyección de Arte Multimodal
El modelo abierto que de verdad canta las palabras que le diste.
ASLP Lab
Canciones de larga duración generadas en una fracción del tiempo habitual.
Stability AI
El modelo abierto con un conjunto de entrenamiento que realmente puede nombrar.
Meta AI
Tararea una idea y obtén un arreglo — el modelo original condicionado por melodía.
Meta AI
El modelo rápido de Meta: la misma calidad sin la espera secuencial.
Volver a separar una mezcla terminada en stems.
Herramientas para consumidores y creadores construidas sobre modelos de generación.
Musicfy
Una plataforma de transformación de voces más que un generador de canciones.
Soundful
Pistas basadas en plantillas para creadores que quieren lo predecible, no lo sorprendente.
Loudly
Generación más una biblioteca, para cuando la generación sola no alcanza.
Soundraw
Edita el arreglo sección por sección en lugar de regenerar.
Boomy
El camino más corto de nada a una pista en un servicio de streaming.
Mubert
Música continua, que nunca se repite, hecha para incrustarse.
AIVA Technologies
El que te entrega MIDI en vez de un archivo terminado.
LALAL.AI
Separación de stem para gente que no quiere instalar nada.
MusicGenerate está hecho para enrutar entre modelos en vez de apostar por uno. El catálogo de arriba es lo que seguimos y evaluamos; qué modelos están conectados al producto en cada momento es otra cuestión, y la respuesta cambia según cambia el campo. Las cifras en cada página llevan la fecha en que se verificaron, porque un benchmark en esta categoría se queda viejo en un trimestre.
Por dentro
Comparados por lo que entregan, cuánto control tienes y lo que permite la licencia.

Modelos que escriben, arreglan e interpretan en una sola pasada — la categoría a la que la mayoría se refiere por “música con IA”.
1 / 5
Por qué existe esto
La calidad del resultado se oye fácil. Los términos son los que de verdad deciden si puedes publicar.
Genera música gratisDos modelos pueden sonar parecido y diferir por completo en si puedes publicar el resultado. Esa es la primera pregunta, no la última.
Un modelo descargable puede igual traer una cláusula no comercial. Alojarlo tú no cambia lo que permite la licencia.
Cada ficha lleva la fecha en que se verificaron sus datos, porque una página que parece actual y no lo es es peor que una que admite su edad.
Una página de modelo sin sección de limitaciones es un folleto. Los límites son la parte que la gente busca.
Para quién es

Decidir en qué estandarizarse antes de comprometer un flujo de trabajo.

Poniendo en la balanza el acceso por API, el alojamiento propio y los términos de la licencia.

Descifrando cuál es bueno en lo que realmente hacen.

Siguiendo qué cambió entre versiones.
Explorar
Depende del trabajo. Suno lidera en realismo vocal, Udio en edición tras la generación, ElevenLabs en control estructural, Stable Audio en textura instrumental y autoalojamiento, y AIVA en MIDI editable.
Stable Audio Open, ACE-Step, YuE, MusicGen, MAGNeT y DiffRhythm publican pesos abiertos. Sus licencias difieren mucho — ACE-Step y YuE son Apache 2.0, mientras que otras restringen el despliegue comercial.
Un modelo es el sistema que genera audio; una plataforma es el producto construido alrededor de uno. Suno y Udio son plataformas con modelos cerrados; MusicGen es un modelo que puedes ejecutar tú mismo.
Solo algunos. Los modelos con Apache 2.0 lo permiten sin rodeos; varias licencias de investigación no. La licencia cubre los pesos y no dice nada sobre los datos con los que se entrenaron, que es otro riesgo aparte.
Suno v5 marca hoy el listón: respiración, vibrato y fraseo dinámico se interpretan en vez de aproximarse, y es la ventaja más clara y única que cualquier modelo de este directorio tiene.
Cada ficha lleva la fecha en que se verificaron sus datos por última vez. Este campo se mueve rápido, así que toma cualquier especificación de hace unos meses como algo que vale la pena revalidar con el proveedor.
Describe lo que quieres — nosotros decidimos qué modelo se ejecuta.