Crear un sonido natural e inaplicable es el objetivo principal en la masterización profesional de audiolibros. Los oyentes consumen audiolibros en una amplia variedad de ambientes: coches ruidosos, dormitorios tranquilos, gimnasios bulliciosos y espacios de reproducción. Una estrategia de igualación (EQ) que suena neutral y transparente en un entorno puede fácilmente llegar a ser fatiguo o ininteligible en otro.
La relación entre el EQ y el oído fatiga
El sistema de sonido es un sistema de sonido que se traduce en una gran cantidad de presión, que se traduce en una gran cantidad de esfuerzo de sonido, que se traduce en una gran cantidad de esfuerzo de sonido y que se traduce en un sistema de sonido.
Mapping the Narrator's Voice Spectrum
Antes de aplicar cualquier procesamiento, es esencial entender las frecuencias específicas que rigen la percepción vocal. La voz humana es un instrumento complejo, y su carácter se define por la interacción de frecuencias y formadores fundamentales. Para el dominio de audiolibros, el espectro puede ser descompuesto en zonas distintas, cada una que requiere atención específica.
La Fundación: Sub-Bass y Bass (20 Hz – 200 Hz)
Esta región contiene los pulsos de la trama y la frecuencia fundamental de la voz. La frecuencia fundamental para una voz masculina normalmente se encuentra entre 80 Hz y 180 Hz, mientras que una voz femenina se sienta más alta, generalmente entre 150 Hz y 250 Hz. Mientras que la frecuencia fundamental en sí es crítica para la percepción del campo, la información inferior a 50 Hz es casi siempre problemática.
Calentamiento y Poder: Los Medios Bajo (200 Hz – 500 Hz)
Esto se llama a menudo el "cuerpo" de la voz. Una cantidad sana de energía en esta gama da al narrador una sensación de autoridad, intimidad y calor. Sin embargo, esta región es también la fuente más común de "mud." Los espacios de grabación mal tratados a menudo tienen ondas de pie alrededor de 250 Hz, y los micrófonos direccionales pueden aumentar artificialmente estas frecuencias a través del efecto de proximidad.
Claridad y Presencia: Los Medios Superiores (500 Hz – 2 kHz)
La parte superior de la gama es el motor de la inteligibilidad del habla. El oído es altamente sensible a esta región porque contiene los formantes que distinguen las vocales. La mayoría de la "presencia" de una voz vive alrededor de 1 kHz. Si esta región está recesada, la voz sonará distante y silenciada. Si es demasiado agresivo, la voz se vuelve estridente y grasificante.
Detalle y silencio: La gama de Presencia y Brilliance (2 kHz – 8 kHz)
Esta región es una espada de doble filo. Frecuencias entre 2 kHz y 4 kHz son críticas para el ataque de consonantes como "T", "K" y "P." El bosteo aquí puede agregar crujiente y definición. Sin embargo, esta es también la región donde "sibilance" (soyos "S" y "Sh") se puede escuchar más adelante.
La banda de aire: frecuencias altas (8 kHz – 20 kHz)
Para el dominio de audiolibros, la banda de aire se trata con precaución. Aunque puede añadir un sentido de apertura y realismo, a menudo lleva más ruido que el contenido musical. Un filtro suave de baja velocidad (LPF) o un alto estante cortado por encima de 10–12 kHz se aplica frecuentemente para reducir el ruido digital, el suyo de cinta, o los artefactos de alta compresión pesada.
Construyendo una Fundación EQ Estatica
El primer paso en cualquier cadena de masterización es establecer una corrección estática de EQ. Esto implica escuchar toda la grabación para encontrar el equilibrio tonal "promedio". Es un error para EQ basado en una sola frase. El EQ estático debe corregir los problemas consistentes y globales de la sesión de grabación.
El proceso suele seguir este flujo de trabajo:
- Escuchar críticamente en múltiples sistemas: El ingeniero escucha la grabación en bruto en monitores de estudio de alta calidad, auriculares de fondo abierto y un sistema de reproducción de consumo (como un altavoz de teléfono inteligente).Una mezcla que suena "derecha" en un sistema neutral pero "boomy" en un altavoz de teléfono requiere un corte en los medios bajos.
- Análisis espectral: Utilizar un analizador en tiempo real (RTA) puede ayudar a identificar los picos resonantes consistentes. Un pico en la gama 180 Hz o un salto en la gama de 2 kHz puede ser confirmado visualmente antes de hacer un ajuste.
- El enfoque "Primero Subtráctico": Antes de aumentar cualquier frecuencia, el ingeniero debe cortar las frecuencias del problema. La eliminación de 3 dB de barro a 300 Hz a menudo hace un impulso de 2 dB a 1,5 kHz innecesario. El EQ subtráctico conserva el cuarto de cabeza y reduce la posibilidad de introducir artefactos de fase o distorsión.
- Filtro de alto par y bajo par: Como se ha mencionado, un filtro de alto paso a 60–80 Hz (24 dB/octave) es estándar. Un filtro de baja velocidad a 15–18 kHz (12 dB/octave) puede eliminar el ruido ultrasónico sin afectar notablemente la voz.
Técnicas avanzadas: EQ dinámico y des-estar
Mientras que el EQ estático corrige el promedio, el discurso humano es dinámico. El contenido de frecuencia cambia dramáticamente de fonema a fonema. Un corte estático aplicado para fijar un sibilante "S" doblará toda la grabación cuando el narrador no está haciendo un sonido "S". El EQ dinámico resuelve este problema aplicando reducción de ganancia sólo cuando las frecuencias específicas superan un umbral.
Nivelación dinámica para el silencio
El desactivado es la aplicación más común de EQ dinámico en el dominio de audiolibros. En lugar de un corte estático en la gama de 5-8 kHz, una banda dinámica EQ se establece con un ancho de banda estrecho (Q) y un tiempo de ataque rápido (1–5 ms). Esta banda sólo se involucra cuando un pico de sibilancia activa el umbral. El resultado es que el "aire" natural y "presencia" de la voz se preservan 90%
Resonancia de la represión
Algunos narradores tienen resonancias vocales específicas que saltan en ciertos tonos. Por ejemplo, un narrador podría tener una fuerte resonancia nasal que aparece sólo cuando golpean el sonido vocal en "hombre" o "cat." Una banda dinámica EQ centrada alrededor de 800 Hz o 1 kHz puede ser ajustada para reaccionar sólo a estos momentos específicos. Esto permite que el tono vocal general siga siendo rico y completo mientras se elimina quirúrgicamente el pico de la ofensiva que ocurren.
Pítcas prácticas en Audiolibros EQ
La curva "Cara Sonriente": Un impulso en el bajo y treble con un corte en el medio es común en la música pop, pero es desastroso para los audiolibros. Cortar los medios elimina la inteligibilidad del núcleo de la voz, forzando al oyente a ceder. La voz humana vive en el medio, y deben ser tratados con respeto.
Sobre-De-Essing: La eliminación de demasiada energía en la gama de 5-8 kHz resulta en un sonido "relatar" o "blanketed". Los sonidos "S" del narrador se convierten en "Th" sonidos. Es mejor dejar un pequeño poco de sibilancia que crear un lisp. El objetivo es reducir la dureza, no eliminar el consonante en conjunto.
EQing en una habitación mal tratada: Un ingeniero que trabaja en una habitación no tratada es esencialmente adivinando. Si la habitación tiene un nulo de 5 dB a 200 Hz, el ingeniero instintivamente aumentará 200 Hz para hacer que la voz suene llena en esa habitación. Cuando se reproduce en un ambiente neutral, esa grabación sonará auge y antinatural.
Ignorando el contexto global: Un audiolibro es una experiencia de larga duración, no una canción de tres minutos. Un ajuste de EQ que suena emocionante durante 30 segundos puede llegar a ser agotador después de 30 minutos. El objetivo "sonido natural" es la sostenibilidad. Si el EQ suena ligeramente demasiado brillante o ligeramente demasiado caliente en una prueba A/B corta, es probablemente demasiado extremo para un libro de 10 horas.
Integración con Compresión y Limitación
La igualación no funciona en aislamiento. El orden de procesamiento puede afectar significativamente el resultado final. Si la compresión pesada se aplica primero, el compresor traerá el ruido de bajo nivel (como clics de boca y tono de habitación) y cambiará el equilibrio tonal reaccionando a las frecuencias más altas. Un flujo de trabajo común es aplicar EQ suave y correctivo antes compresión, seguida de un segundo, más sutil EQ (a menudo un alto estante o un impulso de presencia) después compresión para restaurar cualquier detalle perdido.
Cuando un limitador se utiliza para elevar la intensidad general para cumplir con los estándares de plataforma (como los RMS de ACX -18 dB a -23 dB RMS o los nuevos estándares de ruido basados en LUFS), puede amplificar los desequilibrios espectrales. Una voz que fue perfectamente equilibrada a -20 dB LUFS puede sonar dura en la gama de 3 kHz cuando se empuja a -16 dB LUFS.
Consideraciones de EQ genéricas y específicas
Mientras el sonido natural es el objetivo universal, la interpretación de "natural" varía ligeramente por género.
- Ficción " Narración de caracteres: Un rango dinámico más amplio es aceptable. El EQ puede permitirse un poco más dramático para resaltar las voces de carácter. Un ligero impulso en los medios bajos (200–300 Hz) puede añadir gravedad a un villano masculino, mientras que un impulso en el rango de presencia (3–5 kHz) puede hacer que una protagonista femenina suene más inmediata. El riesgo es inconsistencia; el ingeniero debe asegurar que los cambios de EQ entre los personajes no sonar.
- No-Ficción " Ayuda a sí mismo: La consistencia y la claridad son el rey. La voz necesita sonar autoritativa y frontal. Un enfoque más estricto en los medios superiores (1–2.5 kHz) es común. El extremo bajo se mantiene más apretado (filtro de alto paso, menos bajo medio calor) para mantener el golpe y la claridad. La fatiga del oyente es una preocupación importante aquí, ya que los oyentes están tratando a menudo de absorber información.
- Memorias " Narratives personales: Este género se beneficia del sonido más "natural" y transparente posible. La intimidad es el objetivo. El procesamiento intensivo de EQ puede romper el sentido de una conexión personal. Se prefieren golpes suaves y amplios. Un suave impulso de baja estante para el calor y un impulso de alta estante muy suave para el aire, con una manipulación mínima de gama media, a menudo produce los mejores resultados.
Conclusión: El arte de la igualdad invisible
La igualdad adecuada en el dominio de audiolibros es un ejercicio en la resta y la moderación. Las curvas EQ más exitosas son las que el oyente nunca nota. No llaman la atención a un sonido "derecho" o un sonido "detenido"; simplemente permiten que la historia fluya sin esfuerzo del narrador al oyente. Al entender las frecuencias específicas de la voz, empleando EQ dinámico para la naturaleza de problemas, y respetando
Para más lectura sobre las normas y especificaciones técnicas de la industria, consulte el Requisitos de presentación de audio ACXPara una inmersión más profunda en la física del EQ y la voz humana, Guía de iZotope para entender EQ es un recurso excelente. Además, Sonido en el artículo clásico de Sound sobre el des-essing proporciona técnicas prácticas para manejar el sibilancia en el rango dinámico de la expresión humana.