En la producción de películas y vídeos, uno de los desafíos técnicos más persistentes es mantener un diálogo claro e inteligible en una escena que cambia rápidamente de conversación silenciosa a acción explosiva. Sin un procesamiento de audio cuidadoso, un espectador puede encontrarse constantemente llegando al control de volumen —cambiándolo para capturar líneas susurradas y luego derribarlo para evitar ser volcado por un accidente de coche o una bala.
Compresión de audio en la comprensión
La compresión de audio es una técnica de procesamiento de rango dinámico que reduce la diferencia de nivel entre las partes más ruidosas y silenciosas de una señal de audio. En esencia, un compresor escucha el sonido entrante, y cuando la señal supera un nivel definido por el usuario (el umbral), atenua automáticamente la ganancia. Al mismo tiempo, secciones más silenciosas pueden ser aumentadas (a menudo mediante ganancia de maquillaje) para acercarlos al nivel promedio.
El concepto de rango dinámico es central para entender la compresión. En una escena típica de cine, el rango dinámico de un susurro suave a un almejamiento de puerta puede abarcar entre 30–40 dB o más. Nuestros oídos se ajustan naturalmente a alguna medida, pero cuando escuchan a través de altavoces o auriculares en un entorno de hogar, manteniendo un nivel de escucha promedio cómodo requiere que los picos sean domados y los valles elevados.
Cómo funciona un compresor
Un compresor mide continuamente la amplitud de la señal de entrada y la compara con el umbral. Cuando la señal supera el umbral, el compresor reduce la ganancia por una relación definida por el usuario. Por ejemplo, con una relación 4:1, por cada 4 dB de entrada por encima del umbral, sólo pasa 1 dB; el resto se atenúa. El tiempo de ataque reduce la velocidad del umbral de transpiración por debajo de la reducción de la señal de ganancia
Tipos de compresor y sus características
No todos los compresores se comportan de la misma manera. Comprender las diferencias entre las topologías de circuito común le ayuda a elegir la herramienta adecuada para el diálogo. Compresores VCA (Amplificador Controlado por tensión) ofrecen control preciso y respuesta rápida, haciéndolos ideales para capturar los transitorios agudos como disparos o puertas de arrastre. Compresores FET (Transistor de Efecto Field) emula el sonido de la analógica vintage con una característica "grab" que puede añadir un golpe a la voz, pero pueden colorear el tono más que los VCA. Compresores ópticos utilizar una fuente de luz y fotocélula para controlar el aumento, lo que resulta en una compresión más suave y musical que funciona bien para nivelar suaves fluctuaciones de diálogo sin sonar dura. Compresores digitales en DAWs a menudo modelan estos tipos análogos o ofrecen opciones lineales de fase para el procesamiento limpio y transparente. Muchos ingenieros combinan un compresor rápido de VCA o FET para el control de pico con un compresor óptico más lento para el nivelado general, una técnica conocida como compresión en serie.
El papel de la compresión en la coherencia del diálogo
El diálogo es la columna vertebral de la mayoría de los medios narrativos. Ya sea un secreto susurrado en una habitación tranquila o un orden gritado en medio de un campo de batalla, el público debe ser capaz de escuchar y entender cada palabra. En escenas dinámicas, el desafío es doble: efectos sonoros fuertes y la música puede enmascarar el diálogo, mientras que los pasajes silenciosos pueden ser inaudibles si el nivel general es demasiado bajo.
Durante una escena con explosiones repentinas, por ejemplo, un compresor bien afinado se aferre inmediatamente a la explosión, impidiendo que se acelere la pista. Al mismo tiempo, la ganancia de maquillaje del compresor asegura que el diálogo posterior —quizás dicho en una voz normal— se mantenga a un nivel de escucha constante. Este equilibrio automático reduce la necesidad de paseos manuales de volumen y garantiza una experiencia de compresión más suave.
Compresión para efectos de voz vs. sonoro
Aunque la compresión puede ser aplicada a una mezcla entera, es a menudo más eficaz para comprimir el diálogo por separado de otros elementos. La compresión del diálogo suele usar una relación moderada (2:1 a 4:1) con tiempos de ataque relativamente rápidos (10-30 ms) y tiempos de liberación media (50–150 ms). Esto preserva el carácter natural del habla al mismo tiempo que se obtienen los picos duros.
Parámetros clave en detalle
Para utilizar la compresión de manera efectiva para el diálogo, es necesario entender cómo cada parámetro afecta el audio. Las siguientes secciones se expanden en los controles esenciales con orientación práctica para la producción de películas y vídeos.
Umbral y ratio
El umbral es el nivel superior que comienza la compresión. Para el diálogo, establecer el umbral justo por encima del nivel promedio del habla -típicamente alrededor de −20 dBFS a −16 dBFS para una voz bien registrada. De esta manera, el compresor sólo activa durante frases más altas o consonantes pico (como plosivos), dejando sin tocar el discurso normal. Si el umbral es demasiado bajo, el compresor trabajará constantemente una vida sin sonido ratio Controla la intensidad de la compresión. Una relación de 3:1 o 4:1 es un buen punto de partida para el diálogo. Las relaciones superiores (8:1 y superiores) se pueden utilizar para limitar —preveniendo cualquier señal de un techo superior— pero tienden a reducir la dinámica natural del habla, haciéndolo sonar innatural y graso. Para material extremadamente dinámico, considere utilizar un enfoque de dos etapas: un compresor extremo suave (2:1) para el nivelado seguido por un material extremadamente dinámico
Ajustes de ataque y liberación para el diálogo
Ataque Define lo rápido que el compresor responde cuando la señal supera el umbral. Para el diálogo, un ataque rápido (5–20 ms) captura breves picos sin afectar el carácter de la voz. Si el ataque es demasiado rápido (bajo 1 ms), puede distorsionar el transito inicial de sílabas. Demasiado lento (más de 50 ms) y sonidos fuertes pueden pasar antes de que la compresión se enganche, derrotando el propósito. Liberar Cuando el compresor deja de aplicar la reducción de ganancia después de que la señal se caiga por debajo del umbral. Para el habla, un tiempo de liberación de 50–100 ms mantiene el ritmo natural. Si la liberación es demasiado rápida, puede escuchar un "golpe" audible mientras la ganancia salta entre palabras. Si es demasiado lento, el compresor puede no recuperarse completamente antes de la siguiente frase, causando niveles inconsistentes.
Maquillaje de ganancia y salida de techo
Después de la compresión, el nivel general se reduce normalmente. Ganancia de maquillaje restaura el nivel promedio, haciendo pasajes más ruidosos en relación con los picos. Objetivo para configurar ganancia de maquillaje para que el nivel máximo del diálogo comprimido coincida con el nivel máximo de la señal no expresada (utiliza un medidor para comparar). Para la entrega de transmisión o streaming, también establece un techo de salida - a menudo llamado un Limitador—para asegurar que la señal nunca supere un determinado nivel (por ejemplo, -1 dBTP para MP4 o -2 dBTP para YouTube). Esto evita la distorsión cuando el audio está codificado.
Técnicas avanzadas de compresión
Más allá de la compresión básica de banda única, varias técnicas avanzadas pueden mejorar aún más la coherencia del diálogo en escenas dinámicas.
Compresión de la cadena lateral
La compresión de Sidechain utiliza una señal externa para activar el compresor. En el audio de la película, una aplicación común es insertar la pista de diálogo en la cadena lateral de un compresor en el autobús de música o efectos. Cuando el actor habla, el compresor se acuesta con los elementos de fondo, creando espacio para la voz sin una bombeo notable. Esta técnica es especialmente eficaz en escenas de acción donde la música y los efectos de sonido compiten con el diálogo.
Compresión multibanda
La compresión multibanda permite al ingeniero controlar el sibilancia (frecuencias altas) separadas de los ruidos de alta frecuencia (por ejemplo, el viento, el ruido del motor) sin afectar el resto del espectro. Por ejemplo, un compresor de banda baja podría reducir los booms subsónicos, mientras que un sistema de compresión de alta banda
Compresión paralela
La compresión paralel (también llamada compresión en Nueva York) combina una señal seca y sin complicaciones con una versión muy comprimida. Esto puede añadir peso y presencia al diálogo sin escalibrar su dinámica natural. Para el diálogo, utilice una relación de 8:1 o superior en el autobús comprimido, con un ataque rápido y liberación media, y mezclarlo en 10-30% del nivel seco.El resultado es una voz más completa que aún conserva su diálogo creativo de alta calidad.
Compresión en serie para la transparencia
La compresión en serie implica el uso de dos compresores en secuencia con diferentes configuraciones.El primer compresor (a menudo con una baja relación y un ataque rápido) capta los picos más altos, mientras que el segundo (con una relación moderada y un ataque más lento) proporciona un nivel suave y general.Este enfoque produce un resultado más transparente que tratar de hacer todo con un compresor, y es común en la postproducción de Hollywood.
Flujo de trabajo práctico para la compresión del diálogo
Ya sea que esté componiendo el diálogo en una estación de audio digital (DAW) como Pro Tools, Logic o DaVinci Resolve Fairlight, o con un compresor de hardware en una etapa de sonido, el flujo de trabajo sigue principios similares.
Paso 1: Establecer el Umbral escuchando
Comience con todas las configuraciones del compresor por defecto o por adelantado. Juega la pista de diálogo e identifique el nivel promedio del diálogo. Establecer el umbral para que el compresor se involucre sólo en el 5-10% más alto de la señal. Observe el medidor de reducción de ganancia: apuntar a 3-6 dB de reducción en los picos. Si el medidor muestra una reducción constante, levante el umbral.
Paso 2: Elija la relación y el tiempo Constantes
Con una relación de 3:1, establece un ataque de 10 ms y la liberación de 80 ms. Escucha cualquier artefacto no natural. Si el diálogo suena aplastado, baja la relación o aumenta el umbral. Si oyes bombear en notas sostenidas (como una sirena en el fondo), ralentiza la liberación. Para sonidos plosivos, aumenta el ataque ligeramente. Repita este ajuste hasta que el diálogo suena natural pero con picos controlados.
Paso 3: Agregue la ganancia de maquillaje
Después de la compresión, el nivel general podría ser inferior. Usar el control de ganancia de maquillaje (a menudo etiquetado como "output" o "gain") para traer el nivel promedio de vuelta para que coincida con la señal no expresada. Esto hace que los pasajes más suaves aparezcan más alto en relación con el pico. El resultado es un volumen uniforme que se sienta bien en una mezcla.
Paso 4: Monitor con auriculares y altavoces
Siempre comprueba el diálogo comprimido tanto en auriculares de alta calidad como en un sistema de sonido típico hogar. Los auriculares revelan artefactos sutiles como la bombeo, mientras que los altavoces muestran cómo la compresión interactúa con la acústica de la habitación. Si es posible, también escuchen en un altavoz de teléfono móvil — muchos espectadores observan en pequeños dispositivos donde el rango dinámico es limitado, por lo que el diálogo es aún más crítico.
Compresión para plataformas de entrega diferentes
Los ajustes de compresión óptimos para el diálogo varían según el contenido. En un cine, el público espera un amplio rango dinámico (hasta 20 dB de diferencia entre silencio y ruido), y la compresión pesada sonará innatural. En contraste, para dispositivos móviles o la compresión en coche, se prefiere un rango dinámico más estrecho (alrededor de 10-14 dB) porque el ruido de fondo y los pequeños altavoces reducen el rango dinámico percibido.
Errores comunes y cómo evitarlos
Incluso los ingenieros experimentados pueden caer en trampas cuando se comprime el diálogo. Ser consciente de estas trampas ayuda a mantener un sonido profesional.
Sobre-Conpresión (El sonido "Calzado")
Aplicar demasiados avances (más de 6-8 dB en picos) aplana la dinámica, haciendo que el diálogo sea insalubre y grasificante. La voz pierde su inflexión natural y su impacto emocional. Para evitarlo, use una relación menor (2:1–3:1) y un umbral más alto para que sólo los picos más extremos sean afectados. Si se necesita más control, considere usar compresión en serie con proporciones suaves en lugar de un compres agresivos.
Bombas y respiración
Cuando el tiempo de liberación es demasiado rápido (menos de 30 ms), el compresor puede reaccionar a cada sílaba, causando un efecto rítmico de "golpe" mientras la ganancia salta entre palabras. Esto es especialmente notable cuando el diálogo tiene pausas o cuando el ambiente de fondo se hincha. Para corregirlo, aumentar el tiempo de liberación o permitir una función de liberación automática. De manera similar, una liberación que es demasiado lenta puede aumentar el nivel de fondo
Ignorar el tono de la habitación y ruido
La compresión amplifica el ruido de fondo porque reduce la distancia entre el suelo de ruido y la señal. Si la grabación original tiene su, hum o aire acondicionado ronble, la compresión hará que estos artefactos sean más audibles. Siempre limpia el audio primero con reducción de ruido o un filtro de alta velocidad (corte debajo de 80 Hz para voz) antes de aplicar la compresión. Esto asegura que la puerta se comprime el diálogo, no es el ruido.
Desapareciendo
El silencio (afecto “s” y “sh” sonidos) puede ser exagerado por compresión porque el compresor reacciona a la energía de alta frecuencia de forma desigual. Usa un de-esser — ya sea un plugin dedicado o un compresor multibanda con una banda de alta frecuencia—antes o después del compresor principal. Coloca el de-esser en la cadena de señal después de la compresión prominente8
Conclusión
La compresión es una herramienta indispensable para mantener niveles de diálogo constantes durante escenas dinámicas en producción de películas y vídeos. Al reducir el rango dinámico y dotar de niveles máximos, permite a los espectadores seguir la historia sin distracción. Comprender los parámetros clave — retenimiento, relación, ataque y liberación— y aplicarlos con cuidado asegura un discurso de sonido natural que puede contener sus propios efectos contra explosiones, música y sonido.
Para más información sobre técnicas de compresión de audio y mejores prácticas para el diálogo, considere la posibilidad de explorar recursos de Guía de compresión de iZotope, el Sonido en el artículo Sonido sobre la compresión del diálogo, y el Audio Engineering Society en el procesamiento de rango dinámico en la postproducción de película. Para un tutorial práctica, visite Flujo de trabajo de compresión de diálogo del Experto en producciónRecuerde: el objetivo es siempre servir la historia —que la compresión trabaje en silencio detrás de las escenas para que el diálogo hable por sí mismo.