La ciencia de la percepción del sonido humano
El sonido es una parte fundamental de la experiencia humana, formando cómo nos comunicamos, navegamos por nuestro medio ambiente y disfrutamos del arte. Sin embargo, el viaje de una vibración física en el aire a una percepción auditiva rica y significativa en nuestro cerebro es una maravilla de la ingeniería biológica y neurológica. Para los profesionales de audio —desde los ingenieros de grabación hasta los productores podcast— un profundo entendimiento de este proceso no es meramente académico.
El sistema auditivo humano es sensible, capaz de detectar ondas de sonido en un rango de frecuencias de aproximadamente 20 Hz a 20,000 Hz. Esta gama, sin embargo, no es uniforme en su sensibilidad. El proceso comienza cuando las ondas de sonido entran en el oído externo y hacen que el tímpano vibra. Estas vibraciones se transmiten a través de los osículos del oído medio (hammer, un mal y un tiburón)
Frecuencia y Percepción de Pitch
La frecuencia es la propiedad física de una onda de sonido, medida en Hertz (Hz), representando el número de ciclos por segundo. Sin embargo, es el correlato perceptual —cuán alto o bajo un sonido nos parece. Un tono de 440 Hz se percibe como la nota musical A por encima de la C media, mientras que un tono de 100 Hz es una nota baja.
Volumen y enojo
La amplitud (nivel de presión del sonido) es una cantidad física medible en los decibeles (dB SPL), la ruidosa es una percepción subjetiva de lo poderoso o intenso que siente un sonido. Nuestro sistema auditivo se adapta a los niveles de ruido ambiente, un fenómeno llamado adaptación auditiva. Un ruido repentino en una habitación tranquila (como un rayo de puerta) es sorprendente porque viola esta adaptación.
Audiencia espacial y localización
Los humanos son notablemente aptos para determinar de dónde proviene un sonido, utilizando tres cues principales: diferencia entre el tiempo interaural (ITD), diferencia entre niveles interaurales (ILD), y filtración espectral por la pinna (el oído externo). ITD surge porque un sonido de la izquierda alcanza el oído izquierdo ligeramente antes que el oído derecho (fractions of a millisecond).
Principios psicoacústicos en Ingeniería de audio
La psicoacústica es el estudio científico de cómo los humanos perciben el sonido. Varios fenómenos psicoacústicos clave informan directamente de técnicas de procesamiento de audio después de la elaboración, permitiendo a los ingenieros crear diseños de sonido más eficientes y eficaces.
Auditorio Masking
El enmascaramiento auditivo ocurre cuando un sonido hace otro inaudible o difícil de escuchar. Hay dos tipos principales: enmascaramiento simultáneo y enmascaramiento temporal. Enmascaramiento simultáneo ocurre cuando dos sonidos ocurren al mismo tiempo, y el sonido más alto (o el sonido con más energía en una región de frecuencia) enmascara el sonido más silencioso.
Bandas críticas y la Escala de Barcos
La membrana basilar de coquelea actúa como un analizador de frecuencias, con diferentes regiones respondiendo a diferentes frecuencias. Esta resolución no es constante; puede agruparse en bandas críticas, que son rangos de frecuencia sobre los cuales el oído integra la información. La escala de corte divide el rango de frecuencia audible en 24 bandas críticas, aproximados como pasos iguales de frecuencia perceptual.
Contornos de igualdad de la deuda y la igualdad de los valores
Como se mencionó anteriormente, nuestros oídos son menos sensibles a frecuencias bajas y muy altas en volúmenes de escucha bajos. Esto significa que una mezcla o un maestro que suena equilibrado a un nivel alto (por ejemplo, 85 dB SPL reproducción) puede sonar sobre-bajo y amortiguador cuando se juega silenciosamente, o tintura y débil cuando se juega con voz alta para compensar la falta de coincidencias.
Aplicación en el procesamiento posterior
Armados con un entendimiento de cómo los humanos perciben el sonido, los ingenieros de audio aplican una gama de herramientas post-procesamiento para limpiar, mejorar y dar forma al audio. Estas técnicas no se aplican aleatoriamente sino con objetivos perceptuales específicos en mente: claridad, presencia, calor, profundidad espacial y comodidad del oyente.
Nivelación y formación de frecuencias
La ecuación (EQ) es la herramienta más fundamental en el procesamiento posterior. Permite a los ingenieros ajustar la amplitud de rangos de frecuencias específicos. Conocer las curvas de sensibilidad del oído humano informa las decisiones de EQ. Por ejemplo, hacer una pista vocal más presente e inteligible, un impulso alrededor de 3 kHz (donde el oído es más sensible) puede ser eficaz, pero el impulso excesivo puede causar fatiga auditiva.
Compresión de rango dinámico
La compresión reduce el rango dinámico de una señal de audio atenuando las partes altas o haciendo partes silenciosas más fuertes. Esto se alinea perfectamente con la necesidad de nuestro sistema auditivo de consistencia y claridad. La compresión pesada puede hacer que una pista de voz se sienta más "presente" y "en su cara", ya que reduce la variación natural dinámica a la que se adaptan nuestros oídos.
Reducción del ruido y desactivación
Las técnicas de reducción de ruido, como la edición espectral y el accionamiento de ruido, se informan por el enmascaramiento. Si el ruido de fondo está presente, puede ser enmascarado por la señal principal, pero en silencio se hace evidente el ruido. Una puerta de ruido muda la señal cuando se encuentra por debajo de un umbral, eliminando el ruido durante las pausas.
Efectos espaciales y reverbios
Efectos espaciales como reverbio, retraso y rebote de la capacidad de percibir el espacio. Una grabación limpia y seca puede sonar artificial porque carece de las reflexiones y el ambiente de un ambiente real. Los ingenieros utilizan reverbio para simular la acústica de una habitación. Por ejemplo, un corto, brillante reverbote con una rápida desintegración puede sugerir una pequeña sala de timón; un reverbio largo y oscuro con una des
Técnicas avanzadas de procesamiento post-procesamiento basadas en la percepción
Más allá de lo básico, las modernas herramientas de audio ofrecen capacidades avanzadas que aprovechan directamente la psicoacústica para un control más refinado.
EQ de la fase dinámica y la fase lineal
EQ dinámico es una herramienta potente que combina las funciones de EQ y compresión. En lugar de un impulso estático de EQ o corte, un EQ dinámico ajusta la ganancia de una banda de frecuencia en tiempo real basado en el nivel de señal de entrada. Por ejemplo, si una frecuencia específica (como una resonancia de la habitación a 150 Hz) sólo se vuelve problemática cuando un cantante canta fuerte, un EQ dinámico puede aplicar un corte sólo durante esos pasajes ruido.
Compresión de banda múltiple y expandir
La compresión multibanda es esencial para el dominio y la refinación de mezclas. Dividiendo la señal en bandas de frecuencia separadas (por ejemplo, baja, media, alta) y comprimir cada uno de forma independiente, los ingenieros pueden gestionar problemas dinámicos que varían según frecuencia. Por ejemplo, las notas de bajo pueden tener oscilaciones dinámicas amplias que causan bombeo y sonidos respiratorios en la mezcla, mientras que las frecuencias altas pueden necesitar una compresión suave para tamizar sibilancia.
Imágenes de Stereo y Procesamiento Media/Side
Las herramientas de imagen de Stereo permiten a los ingenieros controlar la anchura del campo estéreo. Mediante el procesamiento de M/S se divide una señal estéreo en un canal "mid" (centro: compartido por ambos altavoces) y un canal "side" (diferencias derechas izquierda: compatibilidad ambiente y espacio).Esta técnica explota directamente cómo percibimos la ubicación espacial.
Laudness Metering y True Peak Limiting
Medidores de ruido modernos (basados en estándares como ITU-R BS.1770) miden la intensidad percibida con el tiempo, utilizando un modelo que imita la frecuencia y sensibilidad del tiempo de la audiencia humana. Estos metros proporcionan una alta intensidad integrada (LUFS), ruido de corto plazo y verdaderos niveles de pico. Entendiendo que nuestra percepción de la ruidosidad no es la misma que el nivel de máximo, los ingenieros utilizan estos metros para lograr una constante ruido en diferentes sistemas de reproducción.
Conclusión: Integración de la ciencia con el arte
La confluencia de la ciencia auditiva humana y el procesamiento de audio post-procesamiento es una unión poderosa. Cada curva EQ, ajuste de compresión y efecto espacial es un intento de trabajar con —o a veces contra— nuestra percepción natural para lograr una respuesta emocional y estética deseada. El ingeniero experto no confía en adivinanzas; utilizan principios de psicoacústica para tomar decisiones informadas que reducen la fatiga del oyente, aumentan la claridad y crean experiencias de sensibilidad.
Para más lectura sobre psicoacústica, explore el Entrada de Wikipedia sobre psicoacústica. Para profundizar en los contornos de igual enudamiento, vea el ISO 226 estándar. Para técnicas prácticas de masterización informadas por percepción, ver este artículo de sonido en sonidoY para comprender el enmascaramiento auditivo en los codecs de audio, los auditiva página de enmascaramiento es invaluable. Recuerde, la mejor herramienta en el kit de cualquier ingeniero de audio es un oído informado.