Desbloquear la voz humana: crear sonidos similares a los Vocales con la síntesis FM
Frecuencia La síntesis de la modulación (FM) es una de las técnicas más potentes y versátiles en la producción de música electrónica y el diseño de sonido. Aunque su reputación por ser compleja a veces intimida a los recién llegados, las recompensas son inmensas, especialmente cuando se trata de imitar la voz humana. A diferencia de la emulación vocal basada en muestras, la síntesis de FM le permite esculpir texturas de estilo vocal desde cero, dándole un control completo sobre timbre, campo y la síntesis.
¿Qué es la síntesis FM?
La síntesis de FM genera sonido mediante una señal de audio (la modulador) para variar la frecuencia de otra señal de audio (la transportista). Esta modulación crea bandas laterales — nuevas frecuencias que son sumas y diferencias de las frecuencias de transportista y modulador. La riqueza y complejidad del sonido resultante dependen de la relación de frecuencia entre los dos osciladores y el índice de modulación, que controla la profundidad de la desviación de frecuencia.
La técnica fue popularizada a principios de los años 80 por Yamaha cosecharsquo;s DX7 sintetizador, que utilizó varios pares de transportista-modulador llamados operadores. Cada operador podría estar conectado en varios algoritmos, determinando cómo la señal fluye a través del parche. Esta arquitectura sigue siendo la base de la síntesis moderna de FM, encontrada en sintetizaciones de software como Operador de Ableton, Instrumentos nativos FM8, y unidades de hardware como el Korg Volca FM.
Lo que hace que el FM sea particularmente eficaz para los sonidos vocales es su capacidad de generar estructuras armónicas controladas y de tiempo, exactamente lo que hace la voz humana cuando produce vocales y consonantes. Al entender cómo manipular un pequeño conjunto de parámetros, puede crear parches que respiran, lloran, susurran y cantan.
El arte de crear texturas Vocal-like
Por qué FM Synthesis Excels en la Emulación Vocal
La voz humana es un instrumento acústico notablemente complejo. Produce un tono fundamental (controlado por las cuerdas vocales) y una serie de tonos que son moldeados por las cavidades resonantes de la garganta, boca y pasas nasales. Estos picos resonantes, llamados formadores, son lo que distingue un sonido vocal de otro (por ejemplo, "ldquo;ah cosechardquo; vs. "ldquo;ee cosechardquo;). La síntesis FM puede imitar este comportamiento creando un rico conjunto de bandas laterales y luego utilizando sobres y ratios de frecuencia para enfatizar ciertas regiones de frecuencia — simulando eficazmente los formantes.
Además, la voz nunca está estática. Tiene cambios sutiles de deriva de campo, vibrato y amplitud dinámica. La síntesis FM se destaca al reproducir estos matices porque se puede modular la frecuencia de portador con un oscilador de baja frecuencia (LFO) para vibrato, aplicar un sobre de varias etapas al índice de modulación para la evolución de timbral, y utilizar un segundo modulador para añadir componentes de respiración similares al ruido.
La Técnica Central: Configuración de Transportadores y Moduladores
Para comenzar a construir un sonido parecido a la voz, comience con la configuración más simple de FM: un portador de onda sine modulado por otra onda sine. Establezca la frecuencia de portador al lanzamiento deseado (por ejemplo, el medio C para una voz de barítono). La frecuencia modulada debe ser fijada a una relación que produce un espectro de vocales reconocible.
Aquí hay algunas ratios de inicio para los sonidos comunes de vocal:
- "ldquo; Ah fruncidordquo; (como en "ldquo;father recurrdquo;): M:C ratio = 1:1 con un índice de modulación moderado (2 ndash;4)
- "ldquo;Ee cosechardquo; (como en "ldquo;see curvardquo;): M:C ratio = 3:1 o 4:1 con un índice superior (4 latitudes);6)
- "ldquo; Oo pocosrdquo; (como en "ldquo; boomt afectadosrdquo;): M:C ratio = 1:1 con un índice bajo (1 latitudes);2)
- "ldquo; Oh, oh,rdquo; (como en "ldquo; go, dquo;): M:C ratio = 2:1 con índice medio (2 latitudes);4)
Estas ratios producen patrones específicos de banda lateral que aproximan las frecuencias de formate de las vocales correspondientes. Ajusta el índice de modulación y ajusta ligeramente la relación (utilizando el detuning) para marcar en el carácter exacto que desea.
Parámetros clave para la emulación vocal
Índice de modulación
El índice de modulación determina la profundidad de la desviación de frecuencia. Un índice bajo produce un tono puro y simple con pocas bandas laterales. A medida que aumenta el índice, aparecen más bandas laterales y crecen sus amplitudes. Para los sonidos vocales, el índice debe ser variado con el tiempo utilizando un sobre para imitar la forma en que la voz humana cambia la riqueza durante una sílaba.
Relación de frecuencias de modulador
La relación entre el modulador y las frecuencias de portadores forma el carácter armónico general. Las proporciones más altas (1:1, 2:1, 3:1, 4:1) producen espectros armónicos que son típicos de instrumentos de lanzamiento, incluyendo la voz. Las relaciones no-integer (por ejemplo, 1.4:1) crean tonos inarmónicos, metálicos o similares a las campanas, útiles para efectos especiales pero más difíciles de controlar para la ligera deformación.
Frecuencia de los transportistas y Mapping de Pitch
La frecuencia de la compañía fija el campo fundamental. Para los parches vocales, mapee esto a su teclado o secuenciador para reproducir melodías. Muchos sintetizadores FM le permiten escalar la frecuencia de la portadora independientemente del modulador, que es esencial para mantener el comportamiento consistente de formato en diferentes parcelas. Si el modulador de frecuencia escala con el portador (como lo hace por defecto en la mayoría de " ; ratios cerrados; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ; ;
Diseño de sonido práctico flujo de trabajo
Creación de parche Vocal paso a paso
Dejar caerrsquo;s caminar a través de la construcción de un parche simple tipo vocal desde cero. Nosotros nos limitarsquo;ll utilizar una configuración básica de dos operadores FM (1 modulador + 1 transportista) y luego expandirlo.
- Inicializar el parche: Establece el transportista y modulador para las ondas de sine. Establece el transportista a un campo cómodo (por ejemplo, A3 = 220 Hz).
- Establecer la relación modulada: Comience con una relación 1:1. Esto le dará un tono brillante y zumbido con muchos armónicos — similar a un "ldquo;singing saw cosechardquo; pero más nasal.
- Ajuste el índice de modulación: Empieza a 0 y aumenta lentamente mientras juega una nota. Escucha el timbre para espesar. Un valor alrededor de 3 manzanas;5 debe producir un sonido reminiscente de un " dquo;ah cosechardquo; vocal.
- Añadir un sobre al índice de modulación: Forma el índice para que se levante rápidamente en la nota de inicio y luego se descaiga a un nivel de sustentación. Esto imita el transito de ataque de un sonido vocal.
- Fino con desenterrar: Desfina ligeramente la relación modulador (por ejemplo, 1.01:1) para añadir una oscilación sutil y natural, como un temblor de voz natural.
- Agregue un segundo modulador (opcional): La mayoría de los sintéticos FM permiten más de un modulador. Agregue un tercer operador modulando el portaaviones a una proporción de 3:1 o 4:1 con un índice bajo para enfatizar los formantes superiores, dando al sonido un más "ldquo; o "ldquo;ay cosechardquo; carácter.
- Agregue el ruido para la respiración: Mezcla en una pequeña cantidad de ruido blanco filtrado (ruido a través de un filtro de bandpass alrededor de 2 дели;4 kHz) para simular el componente de respiración de la voz humana.
Técnicas avanzadas para el realismo
Formador de forma con moduladores múltiples
Las voces humanas reales tienen múltiples formantes. Un solo modulador sólo puede crear un conjunto prominente de bandas laterales. Al apilar dos o tres moduladores en diferentes ratios e índices, usted puede crear una estructura formativa más compleja que coincide estrechamente con los sonidos vocales específicos. Por ejemplo, un "ldquo;ee prójimo; el sonido típicamente tiene un primer cuerpo alrededor de 300 diente;3
Algunos sintetizadores avanzados de FM, como Arturia DX7 V, ofrecer “formant cosechardquo; presets que utilizan esta técnica fuera de la caja, pero puede replicarla manualmente experimentando con algoritmos de tres o cuatro operadores.
Sendas de retroalimentación para el crecimiento y la textura
Muchas sintaxis FM le permiten recorrer la salida de un operador de nuevo en su propia entrada o en otro operador. Reacción crea armónicos adicionales y puede generar texturas gruñidas, rasposas o distorsionadas que se asemejan a la fríe vocal o el canto de garganta. Comience con una pequeña cantidad de retroalimentación (aproximadamente 10 unidades;20%) en el operador de portadores y ajuste cuidadosamente — demasiada retroalimentación puede convertirse rápidamente en caótica.
Modulación dinámica con los envélopes y los OVNIs
La voz humana está cambiando constantemente. Utilice múltiples sobres para modular diferentes parámetros independientemente:
- Sobre índice de modulación: Controla el brillo y la riqueza del sonido con el tiempo.
- Sobre de Pitch: Añade un ligero salto de tono al comienzo de una nota (como un ataque de voz natural) o una suave diapositiva entre notas.
- LFO para vibrato: Aplicar un triángulo o onda sine LFO a la frecuencia de portador a una velocidad de 5 curvandash;7 Hz con una profundidad de alrededor de 10 manzanas;20 centavos. Esto simula vibrato vocal natural.
- Modulación aleatoria o de muestra y mantención: Añadir fluctuaciones sutiles y aleatorias al índice de modulación o ratio para imitar las imperfecciones de una voz real.
Patches comunes tipo Vocal y sus parámetros
Aquí hay algunos parches de FM de inspiración vocal clásica que puede utilizar como puntos de partida, junto con su configuración aproximada (utilizando una configuración estándar de dos operadores):
- Coro de calentamiento: Sine de portador, ratio Modulador 1:1, Índice 4, lento ataque/desbloqueo en índice, ligero destumbramiento (+5 centavos), reverbio de luz.
- Voz Bass: Transportador sine en baja parcela (80 lindash;120 Hz), Modulator ratio 0.5:1 (subharmonic), Índice 2 Pulndash;3, ataque rápido, índice sostenido.
- Soprano Lead: Sine de portador, ratio de modulador 3:1, Índice 5 comprimidos;7, ataque rápido, decaimiento moderado, añadir un segundo modulador a 5:1 con bajo índice para chispa.
- Modulador de charla (como habla): Use un sobre muy lento en el índice de modulación (200 dentado; 500 ms) con un nivel alto de sustentación, y aplique un LFO lento a la relación modulador para barrer entre formas vocales.
- Whisper Pad: Transportador sine con un índice de modulación bajo (1 latitudes;2), mezcla con el ruido blanco filtrado (bandpass 2 дели; 6 kHz), tiempos de ataque largos / liberación.
Cada uno de estos presets se puede ampliar con operadores adicionales, efectos (reverbio, retraso, coro), y la configuración de filtros para crear texturas más complejas.
Aplicaciones en Producción de Música
La síntesis vocal FM no es sólo un truco — ha encontrado su camino en innumerables discos de éxito, partituras de películas y bibliotecas de diseño de sonido. Aquí están algunas aplicaciones prácticas:
Música electrónica y Pop
En géneros electrónicos como techno, casa y ambiente, los parches vocales FM añaden un elemento orgánico, humano-como a arreglos mecánicos de otra manera. Un coco caliente puede llenar el rango medio de una pista, mientras que un parche de plomo con un carácter vocal corta a través de una mezcla densa. Artistas como Aphex Twin, Boards of Canada, y Björk han utilizado famosa síntesis FM para texturas similares a voces.
Diseño de sonido de películas y juegos
Los parches vocales FM son ideales para crear voces de otro mundo, lenguas alienígenas o susurros sobrenaturales. Debido a que la síntesis es totalmente generativa, puedes diseñar sonidos que evolucionan con el tiempo, perfectos para anotar tensión, misterio o maravilla. Muchos diseñadores de sonido usan FM para crear efectos vocales para sonidos de criaturas, voces divinas o ambientes de fondo de estremecimiento.
Capa con Vocales grabados
Una de las técnicas más eficaces es la capa de un parche vocal FM con una pista vocal grabada. La voz sintética puede doblar la voz natural en una octava diferente, añadir riqueza armónica, o proporcionar una referencia estable en secciones donde la voz natural se deriva. Esta técnica es común en la producción pop moderno y R círculoB.
Herramientas recomendadas y exploración ulterior
Para comenzar a experimentar con la síntesis vocal FM, necesita un sintetizador que admite múltiples operadores y enrutamiento flexible. Aquí están algunas opciones excelentes:
- Instrumentos nativos FM8: Un centro de alimentación con hasta 6 operadores, una extensa modulación de enrutamiento y un oscilador de forma integrada.
- Operador de Ableton: Integrado en Live Suite, con 4 operadores y una interfaz limpia.
- Korg Volca FM: Una unidad de hardware compacta y asequible basada en la arquitectura Yamaha DX7.
- Yamaha DX7 (original o VST): La clásica sintaxis del hardware que definía el sonido de los años ochenta; sus presets incluyen muchos parches vocales.
- Arturia DX7 V: Una emulación de software con características modernas y excelente calidad de sonido.
Para un aprendizaje más profundo, echa un vistazo Sonido en Sound clérigosquo;s serie clásica sobre la síntesis FM y el Guía de la revista de ataque a técnicas FM. Ambos proporcionan amplia información técnica y ejemplos prácticos.
Conclusión
La síntesis de FM ofrece una vía única expresiva y flexible para crear sonidos de voz que se sientan vivos y orgánicos. Al entender la relación entre frecuencias de portador y modulador, dominar el índice de modulación, y aplicar sobres dinámicos y OVNIs, puede crear parches que canten, susurran y respiran. Las técnicas descritas aquí, desde la configuración simple de dos operadores hasta la configuración de varios modelos, le dan la síntesis real