
Términos de producción
Arreglo, mezcla, masterización, cuantización: las palabras para lo que pasa entre una idea y un disco.
44 términos de música y definiciones de producción, ingeniería de audio, modelos generativos y licencias musicales — definidos de una vez, sin definiciones circulares.
Mostrando 44 de 44
Qué tan rápido se mueve un track, contado en pulsos por minuto. Una balada ronda 70, house cae alrededor de 124, drum and bass cerca de 174. El tempo es lo más útil que puedes especificar en un prompt porque cambia la sensación más que la instrumentación.
La nota base a la que resuelve una pieza, y si usa escala mayor o menor. Mayor se percibe brillante o estable; menor, más oscura o sin resolver. Dos tracks en la misma tonalidad se pueden superponer o mezclar sin chocar.
Una notación de DJ que renombra cada tonalidad como un número más A o B — 8A, 8B, 9A. Las tonalidades contiguas en la rueda suenan bien juntas, lo que vuelve la mezcla armónica aritmética en vez de teoría.
El orden de secciones en una song — verso, coro, puente — y cuánto dura cada una. La estructura es lo que hace que un track se sienta inevitable y no arbitrario.
El carácter de un sonido, independiente de su altura y volumen: por qué un violín y una flauta tocando la misma nota al mismo volumen se distinguen al instante.
El sonido de un espacio: miles de reflexiones que llegan después del sonido directo. La reverb sitúa una grabación en algún lugar, de un cuarto pequeño a una catedral.
La velocidad de una pieza, medida en pulsos por minuto. El tempo define el feel físico de un track más directamente que cualquier otra decisión.
Un componente de una mezcla exportado por separado: batería, bajo, vocals, todo lo demás. Los stems te dejan reequilibrar o remezclar sin volver a la sesión completa. Separar un archivo estéreo ya terminado en stems es una aproximación, no una recuperación de los originales.
El orden y la duración de las secciones de una song — intro, verso, coro, puente, outro — y qué instrumentos tocan en cada una. El arreglo es lo que hace que un track se sienta como una song y no como un loop que sigue y sigue.
La parte que la gente recuerda y puede cantar. Suele ser la melodía del coro o una frase corta repetida. Un track puede estar bien producido y aun así fallar porque no tiene hook.
La melodía vocal y la letra escritas sobre un instrumental existente. En la producción pop la topline y el track a menudo las escriben personas distintas, por eso “mándame una topline” es un pedido normal.
Equilibrar las partes de una canción entre sí — niveles, paneo, EQ, efectos — para que todo se oiga y tenga su propio espacio. La mezcla decide si un buen arreglo realmente funciona.
La etapa final: hacer que una mezcla terminada sea lo bastante fuerte, tonalmente consistente y que se traduzca bien en altavoces de teléfono, audífonos y un sistema de club. La masterización pule; no puede arreglar una mala mezcla.
Ajustar las notas a una posición exacta de la rejilla. Corrige un tiempo descuidado, y si te pasas elimina el vaivén humano que hace que un groove se sienta vivo.
Dónde se ubica un sonido entre los altavoces izquierdo y derecho. La voz principal, el bombo y el bajo van casi siempre al centro; las guitarras, teclas y coros se abren hacia los lados. Esta convención es justo lo que aprovecha la eliminación de voces del canal central.
Estación de trabajo de audio digital — el software donde se graba, edita y mezcla una pista. Ableton Live, Logic Pro, FL Studio y Reaper son los más comunes.
Generar audio a partir de una descripción escrita. Escribes "beat lo-fi lento con piano polvoriento y ruido de vinilo" y recibes una pista. La descripción cumple el papel que tendría un brief de productor.
La instrucción escrita que le das a un modelo de música. Los prompts útiles nombran género, estado de ánimo, tempo, instrumentación y si se quieren voces. Los prompts vagos devuelven resultados genéricos, porque no hay nada hacia lo cual orientar.
Un método de generación que parte del ruido y lo va quitando repetidamente hasta que queda una salida con estructura. La mayoría de los modelos de audio actuales trabajan sobre un espectrograma o una representación latente aprendida en lugar de muestras crudas, porque el audio crudo tiene demasiados valores por segundo.
Una representación interna comprimida donde la música que suena parecido queda cerca. Generar en el espacio latente en lugar de en audio crudo es lo que hace posible una pista completa en segundos en vez de horas.
Una imagen del sonido: tiempo en un eje, frecuencia en el otro, brillo para la sonoridad. Varios modelos musicales generan un espectrograma y luego lo convierten a audio, lo que permite aplicar técnicas de imagen al sonido.
Convertir audio continuo en una secuencia de símbolos discretos que un modelo pueda predecir, igual que un modelo de lenguaje predice palabras. La calidad del tokenizador limita la calidad de salida: el detalle perdido ahí no se puede recuperar después.
Cualquier cosa que se le dé al modelo para guiar la generación — un prompt de texto, un clip de referencia, un tempo, una letra. Más condicionamiento significa menos sorpresa y más control.
Ejecutar de verdad un modelo entrenado para producir salida, en contraste con entrenarlo. Cuando un generador dice "generando…", está haciendo inferencia, y la espera es tiempo de cómputo.
Partir una mezcla terminada de vuelta en partes. Separadores neuronales como Demucs aprenden cómo suena cada instrumento; la cancelación del canal central, en cambio, aprovecha la geometría estéreo, que es mucho más rápida y mucho menos precisa.
Reproducir la voz de una persona específica a partir de sus grabaciones. Distinto de generar una voz en un estilo. Clonar a un artista con nombre plantea problemas de semejanza y derechos de imagen en un número creciente de jurisdicciones, por eso MusicGenerate no lo ofrece.
Cuántas veces por segundo se mide el audio, en Hz. 44,100 Hz es el estándar de CD y 48,000 Hz es el estándar para video. Tasas más altas capturan frecuencias más altas; por sí solas no hacen que una pista suene mejor.
Qué tan precisamente se almacena cada muestra. 16-bit es calidad de lanzamiento; 24-bit da más headroom mientras trabajas. Una baja profundidad de bits se nota como siseo en pasajes silenciosos.
WAV y FLAC conservan cada muestra; MP3 y AAC descartan información considerada inaudible para hacer los archivos más pequeños. La compresión con pérdida es de un solo sentido: volver a codificar un MP3 agrava el daño en lugar de restaurarlo.
Una medida de sonoridad que sigue cómo de fuerte se oye algo realmente, no solo su nivel pico. Los servicios de streaming normalizan a aproximadamente −14 LUFS, así que masterizar por encima de eso solo hará que lo bajen de nuevo.
La brecha entre el punto más fuerte de una mezcla y el techo donde empieza el clipping. Dejar unos dB de headroom le da a la masterización espacio para trabajar.
Lo que pasa cuando una señal excede el nivel máximo y sus picos se aplanan. Se oye como una distorsión áspera, y una vez impreso en un archivo no se puede deshacer.
Dividir el estéreo en lo que los canales comparten (mid) y en lo que los diferencia (side). Aislar el mid te da, más o menos, el contenido centrado; aislar el side lo quita. Este es el mecanismo detrás del borrado de voces tipo karaoke.
Cuando dos copias de una señal están invertidas entre sí y se suman hasta el silencio. Un problema si pasa por accidente entre micrófonos, y una herramienta si se aplica a propósito para quitar el contenido centrado.
Metadatos guardados dentro de un MP3 — título, artista, álbum, carátula. Los reproductores leen esto en vez del nombre de archivo, por eso un archivo bien nombrado puede seguir apareciendo como "Unknown Artist".
La forma visual de la amplitud en el tiempo. Útil para encontrar silencios, transitorios y límites de secciones de un vistazo; no dice nada sobre la afinación ni la tonalidad.
Pagas una vez, o nada, y no debes más pagos por uso. No significa sin derechos de autor, y no significa sin restricciones — la licencia sigue fijando las condiciones.
Realmente sin dueño, que en música casi siempre significa dominio público por antigüedad. Muy poca música moderna está sin derechos de autor, y la frase suele usarse cuando en realidad se quiere decir libre de regalías.
Permiso para publicar tu propia grabación de la canción de otra persona. Lo que necesita cualquier versión cover, sea tocada por una banda o generada. Cubre la composición, no la grabación original.
Permiso para sincronizar música con imagen — un video, un anuncio, un juego. Es aparte del derecho a distribuir el audio por sí solo, y es la licencia que la mayoría de creadores realmente necesita.
Cada canción tiene dos derechos: la composición (melodía y letra, propiedad del autor) y la grabación sonora (la interpretación específica, propiedad de quien la hizo). Un cover crea una grabación nueva pero sigue usando la composición.
El sistema automático de coincidencias de YouTube. Puede marcar una pista que legítimamente te pertenece si alguien más la registró — incluso en casos donde un audio generado idéntico fue reclamado primero.
Una entidad de gestión de derechos — ASCAP, BMI, PRS — que cobra regalías de ejecución para compositores. Importa cuando la música se toca en público o se emite, no solo cuando se transmite por streaming.
Un acuerdo donde quien encarga la obra la posee por completo, no quien la hizo. Común en publicidad y videojuegos, y conviene dejarlo por escrito antes de entregar nada.
Todas las listas de términos musicales fallan en lo mismo: definen timbre como color de tono y color de tono como timbre, o expanden DAW a software de estación de trabajo de audio digital sin decir para qué lo usarías. Cada entrada aquí parte de lo que el término hace, nombra la decisión a la que pertenece y dice dónde te lo vas a encontrar en la práctica.
El vocabulario viene de cuatro tradiciones que rara vez comparten diccionario. Los términos de teoría musical — tono, tempo, arreglo, estructura de canción — son los más antiguos y los más estandarizados. Los términos de ingeniería de audio como reverb, stem, mezcla y mastering salen del estudio y describen operaciones sobre una grabación más que sobre una composición. Los términos generativos como prompt, seed, modelo e inferencia llegaron en los últimos años desde el aprendizaje automático. Los términos de licencias — libre de regalías, Content ID, uso comercial — son lenguaje legal que decide si puedes publicar lo que hiciste.
Los términos italianos son los que la gente encuentra más opacos, porque describen carácter más que medición. Allegro, andante y largo son indicaciones de tempo, y cada una se corresponde con un rango de BPM que puedes poner en un prompt — que es exactamente lo que hace la entrada de tempo, porque un generador entiende 72 BPM y no entiende de forma fiable largo.
Los términos están agrupados por categoría arriba, y cada uno enlaza a una página que va más allá de una definición: qué significa, por qué importa y qué cambia en tu trabajo una vez que lo conoces.
Por dentro
Producción, audio, modelos generativos y derechos.

Arreglo, mezcla, masterización, cuantización: las palabras para lo que pasa entre una idea y un disco.
1 / 5
Pedir 72 BPM con un rango medio despejado es una instrucción de producción, y da mejor resultado que pedir algo chill.
Cada entrada dice qué significa el término y qué decisión cambia, no solo qué representa.
Si un término nombra algo que una herramienta mide, la entrada enlaza a la herramienta que lo mide.
Stems, timbre y estructura de la canción cargan más confusión de la que una definición de una línea puede aclarar, así que tienen páginas completas.
La mezcla equilibra las partes dentro de una canción; la masterización prepara la mezcla terminada para publicarse en distintos sistemas de reproducción. La mezcla es muchos faders; la masterización es un único archivo estéreo.
Una submezcla de una parte de una canción —las voces, la batería, el bajo— exportada como su propio archivo, para poder reequilibrar o remezclar sin la sesión completa.
Golpes por minuto — qué tan rápido va un track. Es lo más útil que puedes fijar en un prompt, porque los modelos respetan un número mucho más que un adjetivo.
Una estación de trabajo de audio digital: el software donde grabas, arreglas, editas y mezclas. Ableton Live, Logic Pro, FL Studio y Reaper son DAWs.
El carácter de un sonido — lo que hace que un piano y una guitarra tocando la misma nota suenen distinto. Nombrarlo en un prompt empuja más el resultado que nombrar un género.
Para empezar, no. Pero cada término aquí es una palanca en un prompt, y conocer cuatro o cinco es lo que separa el resultado que querías de un promedio de todo.
Pon el vocabulario a trabajar — describe una pista y escúchala.