Por qué los niveles de diálogo consistentes importan

El diálogo lleva la narración en películas, televisión, podcasts y contenido de vídeo. Si los niveles de diálogo oscilan entre susurros y gritos, o si los pasajes silenciosos se entierran bajo música y efectos, el público luchará por seguir la historia. Los espectadores pueden activar subtítulos, ajustar el volumen repetidamente o abandonar el contenido en su totalidad. Más allá de la comprensión, los niveles inconsistentes crean fatiga auditiva y reducen la calidad de producción percibida.

¿Qué es la compresión dinámica de rango?

La Compresión de rango dinámico es una técnica de procesamiento de señales que reduce la diferencia de nivel entre las partes más ruidosas y silenciosas de una señal de audio. En su forma más simple, un compresor atenua la ganancia de cualquier señal que exceda un umbral definido por el usuario. La cantidad de atenuación se determina por la relación. Para el diálogo, una relación entre 2:1 y 4:1 es típica — suficientemente potente para mantener la voz mezclando natural, pero lo suficientemente fuerte como para levantar el diálogo silencioso

Existen varios tipos de compresión relevantes para el trabajo de diálogo:

  • Compresión descendente – reduce la ganancia cuando la señal supera el umbral (más común).
  • Compresión ascendente – aumenta la ganancia cuando la señal cae por debajo del umbral; menos común pero se puede utilizar para elevar el piso de diálogo muy tranquilo.
  • Compresión multibanda – divide la señal en bandas de frecuencia, cada una con su propio umbral y ratio. Útil para controlar el sibilancia o el boominess por separado de la gama media.
  • Compresión paralela (comprensión de Nueva York) – combina una copia fuertemente comprimida de la señal con el original seco, preservando el golpe transitorio al tiempo que agrega densidad. A menudo se utiliza en las mezclas de diálogo para mantener la claridad al mismo tiempo que aumenta la ruidosidad percibida.

Comprender estas variaciones permite elegir la herramienta adecuada para cada desafío de diálogo. Una voz grabada en un ambiente ruidoso con plosivos pesados puede beneficiarse de la compresión multibanda, mientras que una pista de voz grabada en una cabina tratada sólo puede necesitar una compresión suave hacia abajo con una rodilla suave. La clave es igualar el procesamiento al material fuente.

Parámetros de compresión clave para el diálogo

Para utilizar el RDC de manera efectiva, debe entender cómo cada parámetro forma el sonido del discurso. La siguiente tabla resume los ajustes críticos, pero exploraremos cada uno en profundidad:

ParámetroRango típico para el diálogoEfecto
Umbral-20 a -10 dBFS (o relativa a la ruidosidad)Establece el nivel por encima del cual comienza la compresión.
Ratio2:1 a 4:1 (hasta 6:1 para contenido muy dinámico)Determina cuánto aumento se aplica por encima del umbral.
Ataque10–30 ms (más rápido para los picos, más lento para la suavidad)Cuán rápido el compresor se compromete después de que la señal exceda el umbral.
Liberar40–200 ms (la liberación automática suele ser útil)Cuán rápido el compresor vuelve a ganar unidad después de que la señal caiga por debajo del umbral.
KneeFrenilla suave (6–12 dB) para un diálogo transparenteEl inicio gradual de la compresión reduce el bombeo audible.
Ganancia de maquillajeAjuste para llevar el nivel promedio a la ruidosa deseadaCompensa para la reducción de ganancia; a menudo se establece para que coincida con el nivel de salida al nivel de entrada (ganancia de la unidad).

Umbral

Para el diálogo, un buen punto de partida es mirar el nivel de RMS del discurso (a menudo alrededor de -18 a -12 dBFS en una mezcla típica) y luego establecer el umbral de 5 a 10 dB por encima de eso. Si lo estableces demasiado bajo, el compresor funcionará constantemente y la voz sonará el método de escaneo, y sólo se alcanzará el nivel de diálogo dinámico.

Ratio

Una relación de 3:1 es un defecto confiable para el diálogo. En este entorno, cada 3 dB de entrada por encima del umbral se reduce a 1 dB de salida. Para el discurso altamente dinámico (por ejemplo, un presentador con secciones muy suaves y muy fuertes), usted podría aumentar a 4:1 o incluso 6:1. Evite las relaciones por encima de 10:1 (limitación) para el diálogo a menos que usted está creando deliberadamente un efecto, ya que mezclará severamente la película de la película 2DR

Ataque y liberación

Los transientes de diálogo (como plosivos, sibilantes y ataques consonantes) son breves. Un ataque rápido (5-10 ms) alcanzará picos agudos, pero también puede recortar el impacto de la voz si se establece demasiado rápido. Un ataque moderado de 15-30 ms permite que el ataque natural de palabras pase antes de que la compresión comience, preservando la claridad.

Knee

Una rodilla suave comienza gradualmente la compresión ligeramente por debajo del umbral, haciendo que la transición sea más suave. Esto es casi siempre preferible para el diálogo, ya que una rodilla dura puede crear un efecto de sujeción audible, antinatural mientras la señal atraviesa el umbral. Comience con una rodilla suave de 6-12 dB. En algunos compresores, la rodilla se expresa como un porcentaje; 50% de rodilla suave corresponde aproximadamente a 6 dB. Experimento con ambos extremos para escuchar la diferencia

Ganancia de maquillaje

La compresión reduce el nivel máximo, reduciendo el volumen promedio. La ganancia de maquillaje restablece el nivel de salida a una capacidad de ruido adecuada. Muchos ingenieros buscan ganar unidad, que ataque los niveles de entrada y salida, para que puedan comparar las señales procesadas y no procesadas con precisión. Después de la compresión, normalmente necesita añadir 3-6 dB de ganancia de maquillaje.

Guía paso a paso para aplicar la RDC para el diálogo

  1. Analizar el camino del diálogo. Use un medidor de ruido (RMS, LUFS) y una pantalla de onda para identificar el rango dinámico. Mire los pasajes susurros más silenciosos y los gritos o exclamaciones más ruidosos. Determine el nivel medio y el nivel máximo. Tenga en cuenta cualquier sección problemática: una línea que salta 12 dB por encima del resto necesitará especial atención.
  2. Pre-proceso con ganancia de clip. Antes de la compresión, ajustar la ganancia del clip (o la automatización de volumen de pista) para incluso superar grandes disparidades. Si una sola línea es mucho más fuerte que el resto, reducir su ganancia del clip. La compresión funciona mejor cuando sólo tiene que manejar un poco de dB de variación en lugar de 20 dB. Este paso ahorra su compresor de trabajar demasiado duro y mantiene el sonido natural.
  3. Establece un umbral de inicio. Coloque el umbral justo por encima del nivel promedio de diálogo, alrededor del punto donde las sílabas más ruidosas comienzan a superar las tranquilas. Para un promedio típico -18 dBFS, intente -10 dBFS como umbral de inicio. Ajuste mientras observa un medidor de reducción de ganancia: apuntar a 3-6 dB de reducción en los picos más altos.
  4. Elige una relación de 3:1. Este es un punto de partida seguro y transparente. Si necesita un control más agresivo, aumente a 4:1 más tarde. Para un contenido muy dinámico, puede utilizar 2:1 inicialmente y añadir un segundo compresor con una relación más alta para el control de pico (comprensión de serie).
  5. Juego de ataque a 15 ms y liberación a 100 ms. Si el diálogo suena aburrido o carece de ataque, aumenta el tiempo de ataque a 20-30 ms. Si escuchas bombear entre palabras, reduce la liberación a 60 ms o cambia a la liberación automática. Si el diálogo suena “estuck” en un volumen reducido, aumenta el tiempo de liberación a 150–200 ms para que la ganancia se recupera completamente.
  6. Involucrar una rodilla suave. La mayoría de los compresores tienen un botón para la forma de rodilla; póngalo a 6–12 dB de rodilla suave. Si su compresor sólo ofrece una rodilla dura, considere usar un plugin diferente o comprobar doble que es apropiado para el material.
  7. Adjustar la ganancia de maquillaje. Escucha la señal comprimida y levanta la salida hasta que la intensidad percibida coincida con la pista no tratada (o hasta que se sienta bien en la mezcla). Usa una palanca de bypass para comparar. Objetivo para ganar unidad para que pueda A/B con precisión.
  8. Verifica reducción de ganancia. Objetivo para 3-6 dB de reducción de ganancia en los picos más altos. Si usted ve más de 10 dB de reducción constante, la compresión es demasiado agresiva - de nuevo del umbral o ratio. Los picos ocasionales de 6-8 dB pueden ser aceptables, pero la reducción sostenida por encima de 10 dB escudriñará la voz.
  9. Escucha múltiples sistemas. Juega tu diálogo comprimido a través de auriculares, altavoces portátiles y un sistema de teatro en casa. Ajuste los ajustes si la voz suena antinatural o si las partes silenciosas son todavía demasiado bajas. Lo que suena bien en los monitores de estudio puede ser demasiado comprimido en los auriculares.
  10. Use un analizador de espectro. Busque desequilibrios: si la compresión aumenta demasiado ruido de bajo nivel, agregue un filtro de alto paso antes del compresor (o utilice un EQ de la cadena lateral para controlar la reacción del compresor a las frecuencias bajas). Un alto paso a 80–100 Hz es estándar para el diálogo, aunque es posible que necesite ajustarse en función de la voz.
  11. Comprobación final con un medidor de ruido. Medir el LUFS integrado y el verdadero pico. Ajuste el aumento de maquillaje o agregue un limitador de ladrillos para asegurar que el nivel cumple con las especificaciones de su plataforma objetivo. El pico verdadero no debe exceder -1 dBTP para la mayoría de los servicios de streaming.

Técnicas avanzadas para la coherencia del diálogo

Compresión de la cadena lateral para el diálogo

La compresión de la cadena lateral permite una señal externa(por ejemplo, música o efectos) para activar el compresor en la pista de diálogo. Mientras más utilizado en la música para atracar bajo voces, también puede utilizarlo en el diálogo mismo: enviar una copia del diálogo a la entrada de la cadena lateral de un compresor que está clave para un rango de frecuencia específico. Por ejemplo, puede comprimir sólo la región de 200–400 Hz para reducir la frecuencia de barro sin afectar la claridad de una frecuencia superior. EQ dinámica y es muy eficaz para limpiar el diálogo en entornos ruidosos. Configuración: duplicar la pista de diálogo, aplicar un filtro de banda-pass a la señal de la cadena lateral, y alimentar eso en la entrada de la cadena lateral del compresor. El compresor sólo reacciona a las frecuencias de esa gama, lo que le permite apuntar áreas problemáticas.

Compresión paralela

La compresión del paralelo (también llamada compresión de Nueva York) implica mezclar una copia fuertemente comprimida del diálogo con el original seco. Esta técnica añade densidad y suavidad sin perder la dinámica natural. Para utilizar la compresión paralela para el diálogo: crear una pista de aux, enviar el diálogo a ella, insertar un compresor con una alta relación (8:1 o 10:1) y rápido ataque/release, y luego mezclar el pulido bajo la pista seca hasta que seca

Compresión de banda múltiple para el silencio y los plosivos

Los compresores de banda única tratan todas las frecuencias por igual. Si su diálogo tiene un exceso de sibilancia (archón “s” sonidos), un compresor de banda completa tratará de controlar el sibilancia pero también puede duplicar la voz. Un compresor de banda multibanda, sin embargo, le permite comprimir sólo el rango de 4-8 kHz, tamizando sibilance mientras deja el resto de la voz de pliegue.

Usando De‐Essers y De‐Plosives

Aunque no se trata de compresión estricta, los desprendices son compresores especializados o EQs dinámicos que apuntan a frecuencias sibilantes. Aplica un desésser antes del compresor principal para evitar que el sibilancia desencadena una reducción innecesaria de ganancia. De manera similar, un filtro de alto paso establecido en 80–100 Hz evitará que los thumps de bajo extremo se ingieren en la cabeza y causan el pósor de problemas.

Errores comunes y cómo evitarlos

  • Sobre-compresión: La reducción de demasiados beneficios (más de 10 dB en picos) hace que el diálogo sea insalubre, plano y graso. Objetivo para un control suave. Si usted necesita más consistencia, considere dos etapas de compresión ligera en lugar de una etapa pesada. La compresión en serie, utilizando dos compresores cada uno con una baja relación, a menudo produce un resultado más transparente que un único compresor con una alta relación.
  • Bombeo y respiración: Fluctuaciones de volumen auditivas causadas por tiempos de lanzamiento demasiado cortos (golpe) o demasiado largos (respiración). Usar la liberación automática o establecer la liberación para que coincida con el ritmo natural del habla (normalmente entre 50–150 ms). El consumo es especialmente notable en la música de fondo o tono de habitación cuando el compresor se recupera; una liberación más larga o auto-release puede suavizar esto.
  • Ignorando el medidor de ruido: El aislamiento sólo en sus oídos puede llevar a una ruidosa intensidad incoherente en escenas. Use un medidor de ruido integrado (LUFS) y mida tanto el solo de diálogo como en la mezcla. Meta -23 LUFS ±0.5 para la emisión, o -14 LUFS para plataformas en línea. La ruido a corto plazo no debe variar por más de ±3 LU dentro de una escena.
  • Compresando toda la mezcla en lugar del diálogo: Aplicar un compresor de autobús maestro a toda la mezcla puede comprimir el diálogo indirectamente, pero también afectará la música y los efectos, causando cambios de nivel no deseados. Siempre comprime el diálogo en su propio circuito o autobús primero. La compresión de autobús maestro debe ser reservada para la cohesión final, no para el nivel de diálogo.
  • No usando un filtro de alto paso: El ruido de baja frecuencia de los sistemas HVAC, pasos o manipulación puede desencadenar el compresor innecesariamente. Descargue los bajos antes del compresor o utilice un filtro de alta velocidad de la cadena lateral (a menudo llamado "baja cortada" en la cadena lateral del compresor). Incluso un alto paso suave a 60 Hz puede evitar que el viento retuerde el diálogo limpio.
  • Desvelar la acústica de la habitación: El diálogo grabado en una sala en vivo o reflectante sonará diferente después de la compresión, ya que el compresor traerá tono de la habitación y reverbio entre palabras. Use reducción de ruido o gatito cuidadoso antes de la compresión. Una puerta de ruido con un ataque rápido y liberación media puede silenciar las brechas, evitando que el compresor aumente el ruido de fondo.
  • Utilizando los mismos ajustes para todos los tipos de diálogo: Una escena conversacional entre dos actores necesita una compresión diferente que una narración de voz o una línea gritada en una película de acción. Adapta tus parámetros: la narración a menudo necesita un ataque más lento y una menor proporción para la naturalidad; el diálogo gritado puede requerir un ataque más rápido y una relación más alta para prevenir la distorsión.

Herramientas y complementos recomendados

La mayoría de las estaciones de trabajo de audio digital (DAWs) incluyen compresores capaces, pero plugins dedicados a menudo ofrecen algoritmos más transparentes o flexibles. Aquí están algunas opciones ampliamente utilizadas:

  • FabFilter Pro‐C 2: Excelente retroalimentación visual con un estilo “Punch” que preserva el ataque transitorio. Ofrece una compresión limpia y transparente para el diálogo. La perilla de mezcla seca/tanto es útil para la compresión paralela.
  • Compresor de las olas C1: Un plugin clásico utilizado durante décadas en cine y transmisión. Controles simples y un EQ de la cadena lateral para ajustar la respuesta del compresor. El modo “compand” se puede utilizar para la fijación.
  • iZotope RX: Mientras que principalmente una suite de reparación, los módulos “Dialogue Isolate” y “De-compress” de RX pueden utilizarse creativamente junto con la compresión tradicional. El módulo “Loudness Control” garantiza el cumplimiento de las normas de ruido. El módulo “Spectral De‐noise” puede limpiar una pista antes de la compresión, reduciendo los problemas con el ruido de fondo.
  • Compresores de stock DAW: Pro Tools’ BF‐76 (modulado después de los limitadores vintage), Compresor de Logic (con múltiples tipos de circuitos como “CV clásica” y “Opto”), y ReaComp (Reaper) son todos capaces cuando se utilizan con cuidado. El modo “Platinum Digital” de Logic es muy limpio para el diálogo.
  • Waves NS1 / NS10: plugins de supresión de ruido que limpian el diálogo antes de la compresión, reduciendo la posibilidad de que el ruido de fondo sea impulsado por el compresor. Úsalos en grabaciones ruidosas de ubicación antes de cualquier procesamiento dinámico.
  • Compresores de hardware para sonido en vivo: dbx 160A, Drawmer 1960, o Universal Audio 1176 (o emulaciones) son favoritos para el diálogo debido a su rápida respuesta y carácter musical. La emulación del plugin Universal Audio 1176 Rev A es particularmente buena para añadir presencia mientras controla los picos.

Para una inmersión más profunda, consulte recursos como Guía de Sound On Sound para la compresión del diálogo o guía de compresión integral de iZotope.

Vigilancia y medición de los niveles consistentes

Incluso los mejores ajustes de compresor pueden ser desechados por un control deficiente. Utilice siempre monitores calibrados y verifique su nivel de diálogo contra una referencia. LUFS (unidades de ensaudamiento en relación con Escala Completa) como el estándar para la ruidosidad percibida.

  • Televisión por radio: -23 LUFS (AL-pesado), con una tolerancia de ±0.5 LU y verdadero límite máximo de -2 dBTP.
  • Streaming (YouTube, Netflix, Amazon): Típicamente -14 LUFS (integrado) con un verdadero pico de -1 dBTP. Netflix especifica -27 LUFS para el diálogo menos otros elementos.
  • Podcasts y audiolibros: -16 a -18 LUFS es común, con un verdadero pico alrededor de -3 dBTP. Los audiolibros a menudo requieren un rango dinámico extremadamente ajustado para una escucha cómoda, por lo que la compresión puede ser más pesada.

Use un plugin de medidor de ruido (por ejemplo, Waves WLM, iZotope Insight, Youlean Loudness Meter) para medir el diálogo después de la compresión. Asegúrese de que la ruidosidad a corto plazo (3 segundos ventana) no varía más de ±3 LU en toda la escena del diálogo. Si lo hace, ajuste su umbral o considere usar un paso de automatización de volumen para suavizar los cambios de nivel restantes.

Calibra tu nivel de monitoreo a una referencia conocida, como -20 dBFS ruido rosa a 83 dB SPL (C-pesado). Esto asegura que tu percepción de la ruidosidad coincida con las condiciones de escucha estándar. Sin calibración, puedes sobre-comprimir porque estás mezclando demasiado silencio o demasiado fuerte.

Conclusión

Dynamic Range Compression es una herramienta indispensable para lograr un diálogo coherente e inteligible en cualquier producción audiovisual. Al entender cada parámetro compresor —threshold, ratio, ataque, liberación, rodilla y ganancia de maquillaje— se puede adaptar el procesamiento a las características específicas del discurso y la mezcla. Comience con ajustes suaves (ratio 3:1, ataque moderado, rodilla suave) y escuchar críticamente.

Para una lectura más detallada, explore el Recomendación de ruido EBU R128 y el AES paper on dynamic range control in broadcast. También echa un vistazo a ITU‐R BS.1770 standard para una mirada autorizada a la medición de la ruidosidad.