De-esser: Suaviza los sonidos "s" ásperos en las voces.
Por qué la sibilancia se convierte en un problema en una mezcla
Las sibilantes aparecen con consonantes como S, Z, T y Sh; su energía se concentra entre aproximadamente 4 y 10 kHz, dependiendo de la voz y el micrófono, con mayor frecuencia en el rango de 5 a 8 kHz. Sin embargo, en grabaciones sin procesar, a menudo son apenas perceptibles. Se vuelven problemáticas, sin embargo, debido al procesamiento vocal típico: A Compresor Resalta los pasajes silenciosos y, por lo tanto, también pone en primer plano los sonidos sibilantes, una altura enfatizada. EQ Para lograr mayor claridad, amplifica con precisión su rango de frecuencias, y la saturación añade armónicos adicionales. La microfonía cercana con micrófonos de condensador sensibles también enfatiza la sibilancia.
El resultado: una voz que suena bien en solitario destacará desagradablemente en la mezcla final con cada sonido de "s", especialmente con auriculares y a volúmenes altos. Aquí es precisamente donde entra en juego el de-esser.

Función: compresión selectiva en frecuencia
En esencia, un de-esser es un compresor cuyo mecanismo de detección no reacciona a toda la señal, sino a una banda de frecuencia filtrada. Así es como funciona:
- Detección: Un filtro en Ruta de la cadena lateral Solo permite el paso del rango de sibilancias establecido (por ejemplo, 6 kHz y superiores) para la medición de nivel.
- Desencadenante: Si la energía en esta banda supera el umbral, la reducción de nivel surte efecto, normalmente solo durante los pocos milisegundos que dura el sonido "s".
- Encapotado: Dependiendo del diseño, se atenúa el ruido de toda la señal o solo de la banda afectada.
Es precisamente en este último punto donde difieren los dos tipos básicos.
Banda dividida frente a banda ancha
- Banda ancha: Si el detector detecta un sonido "S", el procesador reduce brevemente el volumen de toda la señal. Con una reducción moderada, esto suena natural porque se mantiene el equilibrio tonal de la voz; pero con una reducción fuerte, la voz entera se atenúa notablemente.
- Banda dividida: Aquí, la señal se divide en dos bandas y solo se atenúa el rango sibilante, de forma similar a una rápida Compresor multibanda con una sola banda activa. Si bien esto permite correcciones más fuertes, una atenuación excesiva puede producir un sonido ceceante, ya que el sonido "s" pierde su nitidez natural.
Los de-essers modernos (y los ecualizadores dinámicos que pueden realizar la misma tarea) suelen funcionar en modo de banda dividida con ancho de banda seleccionable; el fabricante proporciona una descripción general independiente. Glosario en Wikipedia.
Ajuste del de-esser: Cuatro pasos para un resultado perfecto
- Hallar frecuencia: En primer lugar, utilice la función Listen/Solo del complemento y recorra el rango del detector hasta que los sonidos sibilantes se aíslen con la mayor claridad posible; normalmente entre 5 y 8 kHz, e incluso más alto para voces brillantes.
- Establecer umbral: Luego, reduce el umbral para que solo los sonidos fuertes activen la reducción, y no cada sílaba brillante.
- Limitar el descenso: En la mayoría de los casos, una reducción de ganancia de 3 a 6 dB es suficiente. Si se produce un sonido más agudo, como un ceceo; en ese caso, es mejor utilizar una segunda etapa más suave en otro punto de la cadena de señal.
- Verificar en el contexto de la mezcla: Además, nunca juzgues el resultado basándote únicamente en él. Una S que suena prominente por sí sola podría encajar perfectamente en el arreglo final.
En cuanto a su posición en la cadena: normalmente se coloca al principio de la cadena vocal, antes del ecualizador que realza mucho la voz y antes (o justo después) del compresor, para que las etapas posteriores no amplifiquen aún más la sibilancia. Por lo tanto, vale la pena comparar ambas opciones.
Cuando lo automático ya no es suficiente
Con grabaciones con mucha sibilancia, cualquier de-esser alcanza sus límites. En estos casos, puede ser útil lo siguiente: reducir manualmente los sonidos sibilantes individuales mediante la ganancia de clip o la automatización de volumen (lo más preciso, pero más complejo), usar varios de-esser más suaves en lugar de uno agresivo, o usar un ecualizador dinámico con una banda estrecha. Esto también se aplica a... Voces generadas por IA Los artefactos duros son comunes en este rango de altura, porque las herramientas siguen siendo las mismas.
Y a veces la sibilancia es solo un síntoma: si todo el procesamiento vocal no funciona, vale la pena obtener una perspectiva externa. En Peak-Studios, puedes tener tu Que las voces estén mezcladas La eliminación de sibilancias, la compresión y el ajuste del ecualizador forman parte de todas las mezclas vocales.
Preguntas frecuentes sobre el de-esser
¿Qué hace un de-esser?
Reduce automáticamente los sonidos sibilantes, como la "s" y la "z", en las voces. Funciona como un compresor selectivo en frecuencia que solo reacciona cuando se produce una consonante fuerte en el rango sibilante (normalmente de 5 a 8 kHz). El resto del sonido permanece inalterado.
¿A qué frecuencia debo configurar el de-esser?
Generalmente entre 5 y 8 kHz; dependiendo de la voz, también entre 4 y 10 kHz. Utilice la función Escuchar/Solo para encontrar el rango donde los sonidos sibilantes se aíslan con mayor claridad.
¿El de-esser está ubicado antes o después del compresor?
Lo habitual es colocarlo al principio de la cadena de señal —antes del ecualizador que realza los agudos y antes o justo después del compresor— para que las etapas posteriores no amplifiquen aún más la sibilancia. En caso de duda, compare ambas posiciones.
¿Cuánta intervención es aceptable por parte de un de-esser?
Una reducción de 3 a 6 dB suele ser suficiente. Si la voz suena ceceante, la intervención es demasiado fuerte; en ese caso, es mejor combinar dos instancias más suaves o automatizar manualmente los sonidos sibilantes individuales.
¿Cuál es la diferencia entre un de-esser y un ecualizador?
Un ecualizador reduce permanentemente el rango de frecuencias, atenuando así el brillo deseado de la voz. Un de-esser solo interviene durante los milisegundos en los que se produce un sonido áspero.
¿Necesito un de-esser para las voces de IA?
A menudo, sí: las voces generadas por IA suelen presentar artefactos ásperos y frecuencias altas excesivamente enfatizadas. Por lo tanto, la eliminación de sibilancias y la ecualización dinámica son técnicas de procesamiento estándar también para las voces generadas por IA.