Introducción
En la postproducción de audio para el contenido de película, televisión y streaming, la claridad del diálogo es uno de los factores más importantes para el compromiso del público. Los espectadores pueden perdonar una puntuación de fondo ligeramente barrosa o un efecto de sonido imperfecto, pero el diálogo incierto puede romper la inmersión y causar frustración. compresión multibanda ofrece un enfoque de precisión que aborda las características de frecuencia única de la voz humana. Dividiendo el espectro de audio en bandas discretas y aplicando la compresión independientemente a cada uno, los ingenieros pueden aumentar la inteligibilidad sin introducir artefactos no naturales o sacrificar la sensación dinámica del discurso natural.
Esta guía ampliada recorre la ciencia detrás de la compresión multibanda, su aplicación específica para el diálogo, recomendaciones de flujo de trabajo paso a paso, técnicas avanzadas y trampas comunes para evitar. Si usted es un ingeniero de mezcla experimentado o un creador de contenido que busca mejorar la claridad de voz en sus producciones, entendiendo cómo aprovechar la compresión multibanda efectivamente elevará su calidad de audio.
Comprender el espectro de frecuencias del diálogo
Antes de sumergirse en compresión multibanda, es esencial entender dónde vive el diálogo en el espectro de frecuencias. El discurso humano abarca aproximadamente 80 Hz a 8 kHz, pero la inteligibilidad crítica reside en una banda más estrecha. Las frecuencias fundamentales del discurso masculino normalmente se sitúan entre 80 Hz y 180 Hz, mientras que los fundamentos del habla femenina van desde 180 Hz a 300 Hz.
La mayor inteligibilidad proviene de la región de presencia (unos 2 kHz–5 kHz) y la región de sibilancia (5 kHz-8 kHz). Sin embargo, el ruido de fondo, la música y la acústica de la habitación a menudo enmascaran estas frecuencias críticas. Una baja frecuencia resonada de un sistema HVAC o una calle ocupada puede oscurecer el tono fundamental, mientras que una banda sonora de choque puede competir directamente con la región de presencia.
¿Qué es la Compresión de Banda Multi?
La compresión multibanda es una técnica de procesamiento dinámico que divide la señal de audio en dos o más bandas de frecuencia utilizando filtros crossover. Cada banda pasa a través de su propia etapa de compresión, que se puede configurar independientemente con su propio umbral, relación, ataque, liberación y configuración de la rodilla. Después de la compresión, las bandas se resumen de nuevo para formar la señal de salida.
Los compresores de banda multibanda típicos ofrecen entre dos y cinco bandas, con tres bandas (bajo, medio, alto) siendo los más comunes. Los puntos de cruce son ajustables, lo que le permite definir exactamente qué frecuencias son afectadas por cada banda. Algunos plugins avanzados también cuentan con filtros de Q variable o cruces de fase lineal para minimizar la distorsión de fase cerca de las frecuencias de cruce.
Esta técnica difiere de la compresión de banda única, que aplica la misma reducción dinámica en todo el rango de frecuencias. Con un compresor de banda única, una nota de bajo alto puede desencadenar la compresión que también reduce el nivel del diálogo en los medios, aunque los mediados no necesitaban reducción. La compresión de banda múltiple evita esta contaminación cruzada, ofreciendo control quirúrgico sobre las regiones de frecuencia problemática mientras que deja a otros sin tocar.
Para una visión más profunda de la teoría de la compresión de bandas múltiples, Sound On Sound proporciona una excelente referencia.
Por qué la Compresión Multibanda importa para la Claridad del Diálogo
El diálogo en cine y televisión se enfrenta a menudo a una mezcla desafiante de elementos competidores. Un personaje puede susurrar mientras un coche conduce por; un actor puede gritar sobre un sonido musical; una escena en un café puede incluir chácteos ambiente y copas de cierre. En cada caso, la señal vocal central necesita ser inteligible, pero la dinámica del audio circundante puede empujar las frecuencias de discurso clave en la inaudibilidad o hacer que suban a pico con dureza.
La compresión multibanda aborda dos cuestiones principales:
- Masking: Cuando el ruido de fondo o la música se superpone con el rango de frecuencias del discurso, el discurso puede enmascararse parcialmente o completamente. Al aplicar la compresión a las bandas medias y altas donde reside el diálogo, puede reducir el nivel de sonidos competidores que comparten esas frecuencias, desenmascarando eficazmente la voz. Alternativamente, comprimir la banda baja puede evitar que el ruido desencadene la reducción de ganancia en las bandas del discurso.
- Inconsistencias dinámicas: Una sola línea de diálogo puede variar salvajemente en el nivel de principio a fin. Un susurro seguido de un grito puede causar fatiga del oyente o requerir automatización de volumen manual. La compresión de banda múltiple ayuda a suavizar estas variaciones reduciendo el aumento de segmentos más fuertes sólo en las bandas que lo necesitan, manteniendo una ruidosa percibida más consistente sin escapar toda la señal.
Además, la compresión multibanda puede domar el sibilancia sin afectar al resto de la voz. Al establecer una banda alta (6 kHz-8 kHz) con un ataque rápido y una relación moderada, puede capturar sonidos duros “s” antes de que se distraigan, preservando un carácter vocal natural.
Cómo aplicar la compresión multibanda al diálogo: Un flujo de trabajo paso a paso
A continuación se muestra un enfoque práctico para usar compresión de banda múltiple para el diálogo, aplicable en cualquier DAW que apoye el formato plugin de su elección (por ejemplo, iZotope RX, FabFilter Pro-MB, Waves C4, o stock compresores de banda multibanda DAW). Las configuraciones variarán dependiendo del material fuente, pero estas directrices proporcionan un punto de partida fuerte.
Paso 1: Analizar el diálogo
Escucha cuidadosamente la pista de diálogo en aislamiento y en contexto. Identificar áreas problemáticas: ¿son los sibilantes demasiado ruidosos? ¿Se pierde el diálogo cuando entra la música de fondo? ¿Hay baja frecuencia de los golpes de pasos o el manejo del ruido? Use un analizador de espectro o una herramienta de visualización de frecuencia para determinar los rangos exactos donde ocurren los problemas. Por ejemplo, si el diálogo se vuelve fangoso con una baja resonancia de pecho, es posible que necesites H250.
Paso 2: Establecer frecuencias cruzadas
Basado en su análisis, establece los puntos de cruce para aislar las bandas de frecuencias relevantes. Una configuración típica de tres bandas para el diálogo podría ser:
- Banda baja: 20 Hz – 250 Hz (controles de ron y bajo)
- Banda media: 250 Hz – 4 kHz (cubre la mayoría de los fundamentos del discurso y la presencia)
- Alta banda: 4 kHz – 20 kHz (desbordes de sibilancia y aire)
Para una voz con un fuerte sibilancia, puede que la banda alta se ponga en el cruce de la banda más baja, alrededor de 3,5 kHz. Para una voz que suena boxeada, puede dividir la banda media en dos (250–800 Hz y 800–4 kHz) utilizando un compresor de cuatro bandas.
Paso 3: Establecer el Umbral y la Ratio para cada Banda
La compresión de la captación sólo en las bandas que lo requieren. En muchos escenarios de diálogo, la banda baja puede no necesitar compresión si el ruido es mínimo. Comience con la banda media: establecer el umbral para que se involucre 2-6 dB de reducción de ganancia durante las partes más altas del diálogo. Una relación de 2:1 a 4:1 es típica. Para la banda alta, utilice un ataque más rápido (unos 0,5–2 ms) con un umbral moderado para alcanzar el sibilance
Paso 4: Ajuste los tiempos de ataque y liberación
Para la banda media, utilice un ataque moderado (10-30 ms) para permitir que el consonante inicial se desplome antes de que la compresión se comprometa, preservando el golpe. Los tiempos de lanzamiento deben fijarse entre 40–100 ms para el discurso, dependiendo del tempo del diálogo. Los claves de más rápido (~40 ms) funcionan bien para líneas rápidas, mientras que los lanzamientos más lentos (~100 ms) ayudan a suavizar frases más largas
Paso 5: Use las Comparaciones de ganancia y bypass de maquillaje
Después de configurar la compresión, utilice el beneficio de maquillaje para traer el nivel general de vuelta a una ruidosidad comparable. A/B pasa por el compresor de bandas múltiples para asegurar que los cambios son beneficiosos. Escuchar los artefactos como bombeo, respiración o cambios de timbre no naturales cerca de frecuencias cruzadas. Fina la pendiente de cruce y ganancia de banda según sea necesario. Muchos compresores de banda multibanda modernos ofrecen un “reducción de banda”
Para una mirada más detallada en los ajustes de ataque y liberación para el discurso, guía de iZotope sobre compresión de bandas múltiples ofrece ejemplos prácticos.
Técnicas avanzadas
Una vez que dominas el flujo de trabajo básico, prueba estos enfoques avanzados para perfeccionar la claridad del diálogo.
Compresión de banda ancha
Si la música de fondo o el ambiente enmascara constantemente el diálogo, inserte un compresor de bandas múltiples de la cadena lateral en la música o en la pista de ambiente. La entrada de la cadena escucha la pista de diálogo. Cuando el diálogo juega, el compresor reduce el nivel del audio competidor sólo en las bandas de frecuencia donde se encuentra el contenido clave del diálogo. Por ejemplo, si la música tiene mucha energía en la gama de bandas múltiples de 2–4
Dinámica EQ vs. Compresión de banda múltiple
Los ecualizadores dinámicos (como FabFilter Pro-Q 3 o TDR Nova) realizan una función similar a la compresión multibanda pero con un carácter diferente. Mientras que la compresión multibanda aplica reducción de ganancia en toda una banda, EQ dinámico funciona en un solo punto de frecuencia o dentro de una forma de filtro de campana. Para cortes quirúrgicos en una resonancia específica, EQ dinámica puede ser preferible.
Usando múltiples oportunidades para diferentes escenarios
Una de las realidades del audio de película es que un circuito de diálogo puede cambiar entre escenas interiores tranquilas y escenas exteriores ruidosas. En lugar de aplicar un único ajuste de banda multibanda estática en todo el proyecto, utilice la automatización para cambiar los parámetros de compresor entre escenas. Además, crear instancias separadas basadas en clips o escenas del compresor con ajustes a medida. Esto asegura que el diálogo siga siendo claro si el personaje está en una biblioteca o una tormenta.
Pitfalls comunes y cómo evitarlos
Incluso con ajustes cuidadosos, la compresión multibanda puede introducir problemas si se utiliza incorrectamente. Aquí están los obstáculos más comunes y las formas de evitarlos.
Bombas y artefactos respiratorios
Los tiempos de liberación impropia, especialmente en la banda media, pueden hacer que el compresor “golpe” o “respirar” como el aumento se eleva y baja con el ritmo de diálogo. Para evitar esto, establece tiempos de liberación que corresponden a la frase natural del discurso. Si escucha el compresor bombear audiblemente, ralentizar la liberación o bajar la relación. Usar una configuración de rodilla (rrodilla suave) también puede suavizar la transición.
Cancelación de fase en puntos de cruce
Los cruces lineales reducen la distorsión de fases pero introducen latencia, mientras que los cruces de fase mínima causan cambios de fase que pueden afectar el equilibrio tonal. Si nota un sonido hueco o “llenado de combos”, trate de ajustar ligeramente las frecuencias cruzadas o cambiar a un modo lineal si su plugin lo soporta. Algunos ingenieros prefieren usar compresores de banda múltiple con aquellos números cruzados diseñados de forma específica para evitar.
Sobre-Compresión y Pérdida de Rango Dinámico
Es fácil de sobre-comprimir el diálogo en un intento de hacer cada palabra el mismo nivel. Esto puede despojar la vida fuera de la actuación, haciendo que suene plana y antinatural. Supervisar la cantidad de reducción de ganancia por banda; apuntar no más de 6-8 dB de reducción en la banda media. Preserve la dinámica de la actuación dejando respirar momentos tranquilos. Utilice la automatización para cambios de nivel significativos en lugar de confiar solamente en la compresión.
Ignorando el resto de la mezcla
La compresión de banda múltiple en una pista de diálogo es sólo una pieza del rompecabezas. Si el diálogo sigue siendo poco claro después del procesamiento, considere cortes de EQ en la música o efectos de sonido para limpiar las frecuencias del discurso, o utilizar des-essers y puertas de ruido de antemano. La compresión de banda múltiple debe ser parte de un enfoque de mezcla holística, no un cura-todo.
Ejemplo: Diálogo de limpieza en un escenario de restaurante ruidoso
Imagina una escena ambientada en un restaurante concurrido. La pista de diálogo contiene dos actores hablando sobre el chat ambiental, gafas de parpadeo y música de fondo bajo. El tono de la habitación es pesado con ruido debajo de 120 Hz. La música compite en la gama 400 Hz–1 kHz, mientras que los cristales clinks crean picos agudos alrededor de 6 kHz.
Utilizando un compresor multibanda de tres bandas en la pista de diálogo:
- Banda baja (20–120 Hz): Establece un umbral alto para que sólo el ruido más alto desencadena la compresión (ratio 4:1, ataque rápido 5 ms, lanzamiento 50 ms). Esto reduce la acumulación de bajo fin sin afectar los fundamentos de la voz.
- Banda media (120 Hz-4 kHz): Aquí es donde vive el diálogo. Establece el umbral para captar los picos más altos de las voces de los actores, apuntando a una reducción de 3–5 dB con una relación de 3:1, atacando 15 ms, liberando 80 ms. Esto suaviza las variaciones de volumen y ayuda a las voces cortadas a través de la música y el chatter competidor.
- Alta banda (4 kHz–20 kHz): Usar un ataque más rápido (1 ms) con un umbral moderado para domar la dureza de los clinks de vidrio y el sibilancia ocasional.
Después de aplicar el compresor, el diálogo se vuelve más presente y consistente. El ambiente del restaurante sigue siendo audible pero ya no enmascara el contenido vocal. Las actuaciones de los actores conservan la dinámica natural, y la escena se siente inmersa sin engordar.
Conclusión
La compresión multibanda es una de las herramientas más eficaces en el arsenal de un ingeniero de audio para mejorar la claridad del diálogo. Al permitir el control específico sobre los rangos de frecuencias individuales, resuelve problemas que los compresores de banda única y los ecualizadores estáticos no pueden. Cuando se aplica con atención cuidadosa a puntos de cruce, umbral, relación, ataque y configuración de liberación, la compresión de banda múltiple puede mejorar la inteligibilidad del habla mientras preserva el carácter natural de la voz humana.
Ya sea que esté trabajando en una película de características, un podcast o un video corporativo, dominar esta técnica elevará la calidad de sus producciones de audio. Comience por analizar el contenido de frecuencia de su diálogo, establecer metas claras para lo que desea lograr, y utilizar el flujo de trabajo paso a paso esbozado arriba como una base. Con la práctica, desarrollará un oído para cuándo y cuánto compresión necesita cada banda, haciendo cada palabra audible y cada rendimiento.
Para la lectura más avanzada y técnicas más avanzadas, Pro Tools Expert tiene un tutorial detallado sobre el uso multibanda específico del diálogo, y Guía de Sweetwater ofrece consejos adicionales para mezclar.