El sonido es un fenómeno físico que nos rodea constantemente, pero la forma en que nuestros cerebros lo interpretan es algo más que simple. Entre los factores más críticos de la percepción de audio está el concepto de diferencia de fase. Este ajuste sutil compensado entre las ondas de sonido que llegan a sus oídos es la base de la audición direccional, la conciencia espacial y la calidad del audio reproducido. Ya sea un ingeniero de audio, un músico o simplemente alguien curioso sobre cómo escucha, la comprensión de las diferencias de fases revela una capa real.

Las diferencias de fase ocurren cuando dos o más ondas sonoras llegan a un punto de escucha en momentos ligeramente diferentes. Este desajuste de tiempo no es un error, es el primer plano que su sistema auditivo utiliza para localizar sonidos en el espacio. Cuando una fuente de sonido es a su izquierda, la onda llega a su oído izquierdo una fracción de milisegundo antes de que llegue a su oído derecho.

El estudio de fase y su efecto sobre la percepción no es sólo académico. Impacta directamente cómo se diseña el equipo de audio, cómo se mezclan las grabaciones y cómo se afinan los entornos de escucha. Los ingenieros manipulan la fase para crear ancho, profundidad e inmersión. Al mismo tiempo, los problemas de fase no controlados pueden degradar la calidad del sonido, causar cancelación y producir fatiga auditiva.

¿Qué son las diferencias de fase?

La fase describe la posición de un punto en el tiempo en un ciclo de onda. Una onda sonora repite con el tiempo, y su fase indica dónde en ese ciclo la onda está en un momento dado. Cuando dos ondas idénticas comienzan en el mismo punto en su ciclo y se mueven juntos, son en fase. Cuando una ola se mueve hacia adelante o hacia atrás en el tiempo relativo a la otra, son fuera de la fase.

La diferencia de fase se mide en grados o radianos, con 360 grados representando un ciclo completo. Un cambio de fase de 180 grados significa que las ondas son exactamente opuestas: donde una onda empuja las moléculas de aire juntas (compresión), la otra las separa (rarefacciones). Esta relación tiene consecuencias dramáticas para el sonido resultante. Cuando dos señales idénticas están completamente en fase, se combinan para producir una señal más fuerte y reforzada. cancelación de fase.

En el contexto de la audiencia humana, las diferencias de fase son más importantes cuando se examinan diferencias entre períodos interaurales (DIT). ITD es la diferencia en el tiempo de llegada de un sonido entre los dos oídos. Para las bajas frecuencias por debajo de cerca 1500 Hz, ITD es el punto dominante para la localización. Para las frecuencias más altas, el cerebro se basa más en diferencias entre los niveles interaurales (DMI), donde la cabeza arroja una sombra acústica que reduce el volumen en el oído lejano. Ambas cues son formas de procesamiento basado en fases, pero ITD está directamente ligado al tiempo de la onda misma.

Las diferencias de fase no se limitan a las señales que llegan a los oídos. También ocurren dentro de un solo canal de audio cuando múltiples micrófonos capturan la misma fuente, cuando los altavoces se colocan a diferentes distancias de un oyente, o cuando el procesamiento digital introduce la latencia. Cada vez que existen dos copias de una señal con un tiempo offset, las relaciones de fase entran en juego.

La ciencia de la percepción de audio

La audición humana es un sistema biológico notable que convierte las ondas de presión mecánica en señales eléctricas que el cerebro interpreta como sonido. El oído externo captura el sonido, el tímpano vibra, y los pequeños huesos del oído medio amplifican esas vibraciones antes de alcanzar la coclea. Dentro de la coclea, las células del pelo convierten la energía mecánica en impulsos neuronales. Pero la corteización — sabiendo de dónde viene un sonido— requiere procesamiento adicional que sucede en el cerebro y el cerebro.

Cómo las diferencias de fase afectan a la localización de sonido

La localización sonora es la capacidad de identificar el origen de un sonido en el espacio tridimensional. Las diferencias de fase son el mecanismo principal de localización horizontal. Cuando una fuente de sonido se encuentra fuera a un lado, la onda de sonido debe viajar un camino más largo para llegar al oído lejano. Esto crea un retraso, que el cerebro detecta y utiliza para calcular el ángulo de incidencia.

  • Fuentes de sonido más cercanas: producir diferencias de fase más pequeñas porque la diferencia de longitud de la ruta entre los oídos es menor en relación con la distancia de origen.
  • Fuentes más sólidas: crear diferencias de fase más grandes en términos absolutos, aunque la resolución angular sigue siendo similar porque el cerebro utiliza el tiempo relativo.
  • Suena en fase: cuando un sonido llega a ambos oídos exactamente al mismo tiempo, el cerebro interpreta esto como viniendo directamente de delante, directamente detrás, o directamente por encima, posiciones donde el camino se extiende a ambos oídos son iguales.
  • Suena fuera de fase: puede producir cues ambiguos de localización, especialmente si la diferencia de fase supera los 180 grados, lo que se conoce como "envoltura de fase".El cerebro puede malinterpretar la dirección o percibir el sonido como difuso.

El sistema auditivo es excepcionalmente sensible a las diferencias de fase. Los humanos pueden detectar ITDs tan pequeños como de 10 a 20 microsegundos en condiciones ideales. Es aproximadamente el tiempo que toma sonido para viajar de 3 a 7 milímetros, menos que el ancho de una punta de dedo. Esta resolución temporal fina nos permite localizar sonidos con una precisión notable, incluso en entornos ruidosos o reverberantes.

El papel de las diferencias entre el tiempo interaural (DIT)

ITD es el cue más importante para localizar sonidos de baja frecuencia. Las bajas frecuencias tienen largas longitudes de onda que se curvan alrededor de la cabeza fácilmente, por lo que la cabeza no arroja una sombra acústica significativa. Como resultado, la diferencia de volumen entre los oídos es mínima. En cambio, el cerebro se basa en la diminuta diferencia de tiempo entre cuando la ola llega a un oído versus el otro.

El ITD máximo ocurre cuando un sonido es directamente a un lado, aproximadamente 90 grados desde el centro. Para una cabeza humana típica, este retraso es de aproximadamente 650 a 700 microsegundos. Los sonidos que llegan desde ángulos intermedios producen retrasos proporcionalmente más pequeños. El cerebro utiliza un mecanismo neurológico llamado "detección de coincidencias" para comparar los tiempos de llegada de cada oído y mapearlos a una dirección específica.

ITD trabaja de forma fiable para frecuencias de hasta unos 1500 Hz. Sobre eso, la longitud de onda se hace más corta que el diámetro de la cabeza, y la relación de fase se vuelve ambigua. Por ejemplo, una onda de 2000 Hz tiene un período de 500 microsegundos, que es más pequeño que el ITD máximo. Esto significa que la misma diferencia de fase podría representar múltiples direcciones posibles, creando confusión.

Función de las diferencias de nivel interaural (ILD)

ILD es la diferencia en el nivel de presión de sonido que alcanza los dos oídos. A frecuencias superiores, la cabeza actúa como barrera, creando una "sube sombra" que reduce la intensidad en el oído lejano. Esta diferencia de nivel se convierte en una señal confiable para la dirección. ILD es más eficaz para las frecuencias superiores a los 2000 Hz, donde la longitud de onda es lo suficientemente pequeña que la cabeza bloquea una parte significativa de la energía de sonido.

El ILD puede ser tan grande como 20 dB o más para sonidos de alta frecuencia que vienen del lado. El cerebro integra tanto los cues ITD como ILD, ponderándolos de acuerdo con el contenido de frecuencia, para crear un percepto espacial unificado. Este sistema de doble caja es robusto en una amplia gama de condiciones de escucha. En entornos del mundo real, el cerebro también utiliza cues moaurales espectro de la elevación externa (pinna) para resolver la confusión frontal.

Diferencias de fase en ambientes de escucha en el mundo real

En una cámara anecóica — una sala libre de reflexiones— las diferencias de fase entre los oídos se determinan casi por completo por el camino de sonido directo. En una habitación normal, las reflexiones de paredes, pisos y techos añaden copias retardadas del sonido, cada una con su propia relación de fase. Esto crea un patrón de interferencia complejo que puede reforzar o cancelar ciertas frecuencias. reflexiones tempranas, son particularmente importantes para la percepción espacial y pueden mejorar o degradar la localización dependiendo de su tiempo y fase.

Cuando las reflexiones llegan dentro de unos 20 a 30 milisegundos del sonido directo, el cerebro tiende a fusionarlos con el sonido directo en un fenómeno llamado el efecto anterior o el efecto Haas. El cerebro utiliza el sonido directo para la localización y suprime la información direccional de las reflexiones. Sin embargo, las reflexiones todavía afectan el timbre percibido, la ruidosidad y la amplitud a través de sus interacciones de fase con la señal directa. Por eso la acústica de la habitación y la colocación de los altavoces tienen un impacto tan significativo en la calidad del sonido.

En el exterior también se producen diferencias de fase de las reflexiones terrestres, efectos atmosféricos y fuentes móviles (el efecto Doppler). En todos los casos, el cerebro analiza continuamente las relaciones de fase entrante para construir una escena auditiva estable. Este procesamiento es tan rápido y automático que rara vez se da cuenta de ello, pero se descompone cuando las relaciones de fase se manipulan artificialmente, por ejemplo, mediante sistemas de audio mal diseñados o procesamiento de señales extremas.

Implications for Audio Technology

Comprender las diferencias de fase no es opcional para nadie diseñando o operando equipos de audio. Desde auriculares hasta sistemas de sonido de sala de conciertos, cada pieza de tecnología de audio interactúa con fases que afectan a lo que oyen. Las aplicaciones más directas están en imágenes estéreo, sonido envolvente y reproducción de auriculares.

Imágenes de Stereo y Fase

En la grabación y mezcla de estéreo, los ingenieros utilizan relaciones de fase para crear un sentido del espacio. La técnica más básica es ajustar la sartén, que controla el volumen relativo de una señal en los canales izquierdo y derecho. Pero la verdadera imagen estéreo va más allá manipulando los retrasos del tiempo y los desplazamientos de fase para simular la forma en que el sonido llega a un oyente en un entorno natural.

Una técnica común es procesamiento de mitad de la cara (M/S), donde la señal se divide en un componente mono "mid" y un componente "side" que contiene información de diferencia estéreo. Al ajustar la fase y el nivel del canal lateral, los ingenieros pueden ampliar o estrechar la imagen estéreo sin destruir la compatibilidad mono. Reanudador estéreo usando el cambio de fase, donde una copia de la señal se retrasa ligeramente o se rompe la fase y se mezcla fuera de la fase para crear un sentido de amplitud. Sin embargo, la manipulación excesiva de fase puede causar problemas cuando la señal se resume en mono, lo que conduce a la cancelación y sonido hueco.

Cuando múltiples micrófonos captan la misma fuente, por ejemplo, un kit de batería con micrófonos y sobrecabezas cercanos, las relaciones de fase entre los micrófonos determinan la claridad y el golpe del sonido general. La fase desalineada puede resultar en un sonido fino y gradual que carece de fin y definición. Muchos ingenieros utilizan herramientas como medidores de correlación de fase y alineación de tiempo para asegurar la coherencia en los micrófonos.

Sistemas de sonido en todo el mundo

Los formatos de sonido alrededor como Dolby Atmos, DTS y Auro-3D dependen en gran medida de la manipulación de fases para crear audio inmersivo. En estos sistemas, los altavoces se colocan alrededor del oyente, y cada altavoz recibe una señal con relaciones de fase específicas relativas a los demás. El objetivo es reproducir un campo de sonido que coincida con el entorno de grabación original o crea un espacio sintético creíble.

En un sistema 5.1 o 7.1, la fase de los canales envolventes se retrasa o se invierte para simular patrones de reflexión. Para formatos basados en objetos como Atmos, cada objeto de audio tiene metadatos que incluyen coordenadas de posición, y el renderizador calcula la fase y nivel adecuados para cada altavoz para colocar el objeto en la ubicación deseada. Esto requiere una gestión precisa de fase para evitar errores de localización y cambios tonales a medida que el oyente mueve su cabeza.

El ajuste de fase de subwoofer es un reto específico en sistemas envolventes. Debido a que los subwoofers reproducen frecuencias bajas con longitudes de onda largas, incluso pequeñas alteraciones de fase entre la subwoofer y los principales altavoces pueden causar cancelación o refuerzo significativos en la frecuencia de crossover. Muchos receptores de AV incluyen un control de fase de subwoofer, a menudo con un rango de 0 a 180 grados, para que coincida con la salida de la subwoofer.

Diseño y fase del auricular

Los auriculares presentan un desafío de fase único porque no hay ITD natural o ILD de la cabeza. Los canales izquierdo y derecho están aislados, por lo que el cerebro no recibe ninguna de las conversaciones cruzadas que ocurren con altavoces. Para crear una impresión espacial natural, los diseñadores de auriculares utilizan crossfeed circuitos que mezclan una pequeña cantidad del canal opuesto en cada oído, con una atenuación de retardo y frecuencia que simula la sombra de la cabeza. Esto restaura algunas de las cuestiones de fase y nivel que ocurrirían naturalmente.

En el registro binaural, se colocan micrófonos en o en una cabeza mutilada para captar la fase exacta y las relaciones de nivel que experimentaría un oyente humano. Cuando se reproducen a través de los auriculares, estas grabaciones crean una imagen espacial extremadamente realista. Sin embargo, las grabaciones binaurales son sensibles a los errores de fase introducidos por el sistema de reproducción, e incluso pequeñas discordancias de tiempo entre los canales izquierdo y derecho pueden destruir la ilusión.

Retos en la gestión de fases

Mientras que la fase es una herramienta poderosa para crear espacio y profundidad, problemas de fase incontrolados pueden arruinar la calidad del audio. Los problemas más comunes incluyen la cancelación de fase, filtración de peines y distorsión de fase inducida por la habitación.

Cancelación de fase

La cancelación de fase se produce cuando dos señales idénticas o casi idénticas se combinan con una fase offset. En frecuencias donde el offset es de 180 grados, las señales se cancelan mutuamente, lo que da lugar a una pérdida de energía a esa frecuencia. Si una señal se divide en dos caminos y luego se recombinó — por ejemplo, en una consola de mezcla o una estación de audio digital— cualquier diferencia en la latencia entre los caminos causará cancelación dependiente de frecuencia.

Ejemplos clásicos de cancelación de fase incluyen un micrófono que recoge el sonido directo de un altavoz y el sonido reflejado de una pared cercana. El sonido reflejado llega más tarde y puede estar parcial o completamente fuera de fase con el sonido directo, causando muslos en la respuesta de frecuencia. Por eso la colocación de micrófono y el tratamiento acústico son críticos en estudios de grabación y lugares de sonido en vivo.

La cancelación de fase no siempre es destructiva. Algunos procesadores de efectos introducen deliberadamente cambios de fase controlados para crear efectos de chorusing, flanging y phaser. Estos efectos funcionan barriendo una fase variable offset en el espectro de frecuencias, creando musculosos y picos que agregan movimiento y textura al sonido. La clave es la intencionalidad — cancelación sin control suena como un problema, mientras que la cancelación controlada suena como un efecto.

Filtro de laboratorio

El filtrado de laboratorio es un tipo específico de cancelación de fase que ocurre cuando una señal se combina con una copia retardada de sí mismo. La respuesta de frecuencia se asemeja a los dientes de un peine, con picos y muletas alternados espaciados a intervalos determinados por el tiempo de demora. El filtrado de laboratorio es común en el sonido vivo cuando una sola fuente es captada por múltiples micrófonos o cuando el sonido directo y reflejado se combina a la posición de un oyente.

En la grabación, el filtrado de peine puede ocurrir cuando dos micrófonos capturan la misma fuente a diferentes distancias. Por ejemplo, un vocalista que canta en un micrófono cercano mientras que también es recogido por un micrófono de sala distante producirá filtrado de peine a menos que las señales estén cuidadosamente alineadas o la relación de fase se gestiona. El resultado es un sonido delgado y hueco que carece de presencia y claridad.

El filtrado de laboratorio se puede minimizar mediante el uso de 3:1 Regla, que afirma que la distancia entre los micrófonos debe ser al menos tres veces la distancia de cada micrófono a la fuente. Esto reduce el nivel de la señal sangrada y hace que la cancelación de fase sea menos audible. En post-producción, herramientas como los plugins de alineación de fase y la compensación de demora pueden corregir los desajustes de tiempo que causan filtración de peine.

Acústica de la sala y fase

Cada habitación tiene un conjunto característico de resonancias y reflexiones que afectan a las relaciones de fase. Las más problemáticas son ondas de pie — frecuencias donde las dimensiones de la habitación son múltiples de la media onda. En estas frecuencias, los nodos de presión y los antinodos forman, causando variaciones severas en la amplitud y fase en toda la sala. Un oyente que mueve su cabeza incluso unas pocas pulgadas puede experimentar cambios dramáticos en la respuesta de bajos percibidos debido a cambios de fase.

Las frecuencias de base son particularmente sensibles a los problemas de fase de la habitación porque sus longitudes de onda largas interactúan fuertemente con los límites. Un subwoofer colocado en un rincón producirá diferentes relaciones de fase que una colocada a lo largo de una pared o en el centro de la habitación. Sistemas de corrección de habitaciones como Dirac Live y Audyssey miden la respuesta de fase y frecuencia en múltiples posiciones de escucha y aplican filtros digitales para compensar la distorsión de fase inducida por espacio.

El tratamiento acústico — trampas de bajo, difusores y absorbedores— puede reducir la gravedad de los problemas de fase de la habitación controlando reflexiones y resonancias. Sin embargo, el tratamiento por sí solo no puede eliminar completamente los problemas de fase. Para escuchar crítica, una combinación de colocación de altavoces cuidadosos, tratamiento acústico y corrección de la habitación digital es el enfoque más eficaz.

Técnicas avanzadas de procesamiento de audio

Las modernas herramientas de procesamiento de audio ofrecen métodos sofisticados para gestionar fase. Equiparadores lineales de fase aplicar ajustes de ganancia dependientes de frecuencias sin introducir cambios de fase, preservando la respuesta transitoria y los puntos espaciales de la señal original. Esto es en contraste con los ecualizadores de fase mínima, que inherentemente añaden cambio de fase que puede alterar el carácter del sonido.

Filtros de paso completo cambiar la fase de una señal sin cambiar su respuesta de amplitud. Estos se utilizan en redes de crossover, decodificadores de sonido envolventes y procesadores de efectos para alinear la fase de diferentes bandas de frecuencia. Cuando se aplica correctamente, los filtros de paso completo pueden eliminar las discontinuidades de fase que ocurren en frecuencias cruzadas, creando una transición sin costuras entre los conductores en un sistema de altavoces multi-way.

Vocoderes de fase y otros algoritmos de estiramiento de tiempo utilizan la información de fase para manipular el tiempo de audio sin alterar el campo. Estas herramientas dependen de analizar la fase de superposición de marcos de transformación de Fourier de corto tiempo y modificar las relaciones de fase para lograr el escalado de tiempo deseado. Esto es computacionalmente intensivo pero permite el estiramiento de tiempo de alta calidad y el cambio de lanzamiento con artefactos mínimos.

En el refuerzo del sonido en vivo, los procesadores de señales digitales (DSP) incluyen líneas de demora y los inversores de fase para alinear a los altavoces en los arrays. Al retrasar las señales a los conductores individuales, los ingenieros pueden asegurar que el sonido de todas las fuentes llegue a la posición de escucha con relaciones de fase coherentes. Esto mejora la claridad, cobertura e inteligibilidad, especialmente en grandes espacios con sistemas de altavoces distribuidos.

La transmisión y la transmisión dependen también de la gestión de fases. Los códigos de audio y los sistemas de transmisión pueden introducir cambios de fase que degradan la imagen estéreo y provocan fatiga auditiva. Las normas como la recomendación de la ITU-R BS.1770 incluyen especificaciones para la consistencia de fases para asegurar que el audio de transmisión mantenga su integridad espacial en diferentes sistemas de reproducción.

Recomendaciones prácticas para los oyentes e ingenieros

Ya sea que esté preparando un estudio de casa, mezclando una pista o simplemente colocando altavoces en su salón, la conciencia de fase puede mejorar dramáticamente su experiencia de audio. Aquí están los pasos prácticos que puede tomar:

  • Comprobar compatibilidad mono: Suma tu mezcla a mono y escucha para la cancelación de fase. Los instrumentos que desaparecen o se vuelven delgados en mono probablemente están experimentando problemas de fase. Ajustar la enrutamiento o utilizar un medidor de correlación para identificar las pistas de problemas.
  • Use un medidor de correlación de fase: Esta herramienta muestra la relación de fase entre los canales izquierdo y derecho en tiempo real. Una lectura cercana a los +1 indica que los canales están en fase, mientras que una lectura cercana a -1 indica que están fuera de fase. Objetivo para una correlación que permanece positiva la mayoría del tiempo.
  • Configuración multi-mic de tiempo: Cuando múltiples micrófonos captan la misma fuente, miden la distancia de cada micrófono a la fuente y aplican retraso para alinear los tiempos de llegada. Esto evita el filtrado de peine y produce un sonido más completo y coherente.
  • Lugar subwoofers estratégicamente: Evite las esquinas a menos que desee maximizar la salida del bajo. Utilice el control de fase del subwoofer para encontrar el ajuste que produce el más golpe y la claridad en la posición de escucha.
  • Trate su sala de escuchas: Use trampas de bajo y absorbedores para reducir las reflexiones que causan la cancelación de fase. Incluso un tratamiento simple puede mejorar la imagen estéreo y reducir la fatiga auditiva.
  • Escucha desde el punto dulce: En una configuración estereotipada, sentarse equidistante de ambos altavoces y en un ángulo de 60 grados para las relaciones de fase más precisas. Las pequeñas desviaciones pueden alterar la imagen estereotipada percibida.

El futuro de la fase en audio

A medida que la tecnología de audio sigue evolucionando, la manipulación de fases se está volviendo más precisa y más accesible. Audio basado en objetos formatos como Dolby Atmos tratan los sonidos individuales como objetos independientes con sus propios metadatos espaciales, permitiendo que el sistema de reproducción haga relaciones de fase dinámicamente basadas en la posición del oyente. Esto crea una experiencia más inmersiva que la mezcla tradicional basada en canales, donde las relaciones de fase se fijan.

Resumir el campo de onda y ambisónicos son técnicas avanzadas de audio espacial que dependen de relaciones de fase cuidadosamente controladas a través de grandes gamas de altavoces para crear fuentes de sonido virtuales en posiciones arbitrarias en el espacio. Estos métodos requieren recursos computacionales masivos pero ofrecen el potencial para una reproducción de audio verdaderamente holográfica.

El audio personalizado es otra frontera. Las mediciones de la función de transferencia relacionada con la cabeza (HRTF) capturan la fase única y los puntos espectrales de los oídos de un individuo. Al aplicar el filtro inverso, los auriculares pueden ser hechos para sonar como altavoces en una habitación específica, completa con relaciones de fase natural. Esta tecnología ya está apareciendo en auriculares de juego de alta gama y sistemas de realidad virtual.

El aprendizaje automático también está entrando en la imagen. Las redes neuronales pueden analizar las relaciones de fase en el audio y predecir artefactos perceptuales, permitiendo a los ingenieros corregir problemas antes de llegar al oyente. Algunos plugins ahora ofrecen alineación automática de fases basada en el análisis de la IA del contenido de la señal. Mientras que estas herramientas no son todavía perfectas, demuestran cómo la comprensión de fase está siendo codificada en software que cualquiera puede usar.

En última instancia, la ciencia de las diferencias de fase no es sólo para evitar problemas, sino que se trata de utilizar una propiedad fundamental del sonido para crear experiencias de escucha más ricas, naturales y más atractivas. Ya sea que esté grabando una sinfonía, mezclando un podcast, o estableciendo un teatro de casa, los principios de fase siguen siendo los mismos. Cuanto más los entiendas, mejor será tu audio.

Para más información sobre la psicoacústica de la fase y localización, las obras de Jens Blauert en "Audición espacial" y Brian Moore en "Una introducción a la psicología de la audiencia" son excelentes recursos. Audio Engineering Society (AES) y Sonido en sonido proporcionar información práctica de ingeniería. Para material técnico más profundo, el Centro de Investigación Informática en Música y Acústica (CCRMA) en la Universidad de Stanford ofrece publicaciones de acceso abierto y herramientas de software. La fase de comprensión es un viaje, y estas fuentes ofrecen una orientación confiable en el camino.