
Inpainting dentro de audio existente
Regenerar un pasaje fallido manteniendo todo alrededor es como funciona la edición en cualquier otro medio, y casi ningún modelo musical lo admite.
Stability AI
Editar dentro de audio existente, no solo generar desde cero.
En pocas palabras
Cifras verificadas 2026-08-10. Este campo se mueve rápido — vuelve a comprobarlas antes de fiarte.
Casi todos los modelos musicales son una función de texto a audio: metes un prompt, sale audio nuevo, sin relación con lo que ya tienes. El inpainting y la continuación de Stable Audio 2.5 rompen ese patrón, y las consecuencias prácticas son grandes. Si un pasaje de cuatro compases en medio de una pieza no funciona, puedes regenerar ese pasaje manteniendo todo alrededor, que es como realmente funciona la edición en cualquier otro medio. La continuación te deja darle ocho compases que tocaste y recibir una extensión coherente en el mismo estilo. La generación de efectos de sonido es una fortaleza real que se pasa por alto porque no es glamorosa — golpes, whooshes, texturas y foley son cosas que los editores de video necesitan todo el tiempo y rara vez tienen. Como compositor no destaca; como herramienta de edición de audio con un motor generativo pegado, es de los modelos más útiles del campo.
Fortalezas

Regenerar un pasaje fallido manteniendo todo alrededor es como funciona la edición en cualquier otro medio, y casi ningún modelo musical lo admite.

Darle compases que tú mismo tocaste y recibir una continuación coherente lo convierte en colaborador sobre material existente, no en una tragaperras.

Golpes, whooshes y foley son necesidades constantes para editores de video y aquí se generan mucho más rápido de lo que se buscan en una librería.
Cómo se compara
Stable Audio 2.5 genera música instrumental y efectos de sonido, y puede editar dentro del audio que le des — hacer inpainting en una sección en medio de un clip o continuar un clip que ya tienes. Esa capacidad de edición es lo que lo separa de la mayoría de modelos de generación.
Comparar con MusicGenerate
Buscado como stable audio 2.5, stable audio inpainting y stable audio sound effects. La capacidad de edición es lo que lo separa de cualquier otro modelo abierto.
Regenerar una sección en medio de un clip existente manteniendo todo alrededor. Si cuatro compases no funcionan, arreglas esos cuatro compases en vez de tirar toda la pista otra vez — así funciona la edición en cualquier otro medio.
Sí. Dale ocho compases que tocaste y produce una extensión coherente en el mismo estilo, lo que lo vuelve un colaborador sobre material existente, no una tragaperras.
Es una de sus fortalezas reales — golpes, whooshes, texturas y foley son necesidades constantes para editores de video y aquí se generan mucho más rápido que buscándolos en una librería.
Usa 2.5 cuando necesites editar dentro de audio existente. Usa 3.0 cuando necesites la salida continua más larga posible.
Las versiones open-weight se pueden descargar gratis y ejecutar en tu propia GPU; el producto alojado funciona por suscripción. La licencia difiere entre uso de investigación y despliegue comercial, así que lee la que viene con tu versión.
No. Es instrumental y centrado en diseño sonoro, por eso aquí lo evaluamos como una herramienta de edición de audio con motor generativo, no como un modelo de canción.
Sigue explorando
Más modelos
Modelos y plataformas que seguimos, comparados por capacidad y licencia.
Editar dentro de audio existente, no solo generar desde cero.