Um guia de processamento de áudio e efeitos para podcasts
Quando você ouve seus podcasts favoritos, o que mais prende sua atenção? Uma história envolvente? A química entre os apresentadores? Uma pesquisa convincente? Embora esses elementos sejam inegavelmente importantes para um ótimo podcast, há algo que pode fazer ou destruir um programa, algo que é, sem dúvida, mais importante do que qualquer outra coisa – a qualidade do som.
Há muitos fatores que influenciam o som de um podcast. Abordamos alguns deles em nosso artigo anterior, Como obter a melhor qualidade de áudio do seu podcast, mas aqui queremos nos concentrar especificamente no processamento e nos efeitos de áudio. Embora os elementos básicos da produção sonora (seu espaço de gravação, microfones, pré-amplificadores, mixers e interfaces etc.) nunca devam ser negligenciados – pois são eles que estabelecem a base de qualquer ótima gravação –, o processamento e os efeitos de áudio são o que fazem um podcast brilhar. Todos os podcasters profissionais os utilizam em algum grau. A seguir, veremos os mais comuns e relevantes para a produção de podcasts.

EQ
O básico
Em poucas palavras, a equalização – ou EQ – é o processo de aumentar ou reduzir o volume (dB) de determinadas frequências em um sinal de áudio para manipular o timbre geral de uma gravação. É um dos processos mais onipresentes na produção sonora e uma etapa importante na mixagem de todos os tipos de áudio para todos os tipos de meios.
Quando você grava um som, o sinal de áudio é composto por camadas de diferentes frequências. Elas se distribuem em um espectro que vai de 20 Hz a 20.000 Hz (a faixa audível para os seres humanos). As frequências mais baixas, de 20 a 250 Hz, são frequências graves; a região média – ou “médios” – é composta por frequências de 250 Hz a 4 kHz; as frequências altas vão de 4 kHz a 20 kHz.
Ajustar EQ terá um impacto diferente na tonalidade do áudio dependendo das frequências que você aumentar ou reduzir, e há infinitas maneiras de esculpir um sinal. Mas não deixe que isso o desanime – existem regras simples e consistentes, além de tipos de equalizadores que você pode aplicar para obter determinada qualidade tonal com o clique de um botão ou o giro de um controle.
Diferentes tipos de EQ
Os equalizadores existem em muitos formatos diferentes – desde softwares na sua estação de trabalho de áudio digital (DAW), passando pelos controles do seu mixer, até chaves no seu microfone (você também os encontrará em guitarras, amplificadores de guitarra, sistemas de som, equipamentos de estúdio como pré-amplificadores e compressores, e muitas outras ferramentas de criação musical e dispositivos de áudio). Os equalizadores mais usados em podcasts são os encontrados em DAWs, como ProTools, Logic ou Audacity, e em mixers ou consoles.
A maioria dos mixers básicos terá três EQ controles para cada canal – um para graves, um para médios e um para agudos. Alguns podem ter apenas um ou dois, enquanto consoles mais avançados, como os encontrados em estúdios profissionais, podem ter mais. Quando estão na posição de 12 horas, esses controles ficam em unidade, o que significa que não há aumento nem redução da frequência. Girá-los no sentido anti-horário reduz a frequência, enquanto girá-los no sentido horário a aumenta. Na maioria dos casos em podcasts, esses três controles serão tudo de que você precisa para moldar sua voz da maneira desejada.
Se você estiver fazendo seu EQ em uma DAW, provavelmente terá muitas outras opções à disposição. Todas as DAWs vêm pré-carregadas com algum tipo de EQ software, e há inúmeros EQs incríveis de terceiros disponíveis se você quiser investir algum dinheiro. Eles permitirão ajustar com precisão a frequência que você precisa aumentar ou reduzir, adicionar filtros para atenuar frequências indesejadas em determinados pontos de corte (low shelf, high shelf, passa-baixas e passa-altas são os mais comuns) e usar predefinições desenvolvidas especificamente para diferentes tipos de voz e aplicações.

O Logic Pro X vem de fábrica com um ótimo plug-in de EQ de canal. Aqui está uma predefinição para limpar uma gravação de voz falada. Observe os cortes na faixa de 20 a 250 Hz e os leves aumentos na faixa de 1 a 20 kHz.
Vozes no espectro de frequências
A fala ocupa principalmente a faixa de 85 a 250 Hz no espectro de frequências, o que significa que é bastante grave – portanto, geralmente é nessa região que você precisará fazer seus ajustes de EQ ao produzir podcasts.
Um filtro passa-altas é uma ferramenta eficaz para moldar vozes em podcasts. Ele permite a passagem apenas de frequências acima de determinado ponto de corte, atenuando as frequências mais baixas. O resultado é uma gravação vocal mais nítida e menos “embolada”.
As vogais, que são sons relativamente pronunciados na fala humana, normalmente ocupam a faixa de 350 Hz a 2 kHz; enquanto as consoantes ocupam a faixa de 1,5 kHz a 4 kHz. Talvez você queira fazer ajustes nessas frequências se notar algo indesejável nas suas gravações. A sibilância – os sons ásperos de “s” e “t” na voz, que se destacam em uma gravação como um dedo machucado – normalmente se concentra na faixa de 4 a 7 kHz, então provavelmente você também vai querer ajustar essa região. Mas tenha cuidado: é nessa faixa superior que sua voz ganha brilho – é uma área delicada que você não deve atenuar demais. Felizmente, existem ferramentas que podem ajudar a controlar a sibilância, o que nos leva a….
De-essing
De-essing é o processo de atenuar a sibilância em uma gravação. Você pode fazer isso manualmente – muitos engenheiros de áudio defendem esse processo, afirmando que ele soa mais natural. No entanto, isso consome tempo e, para o podcaster comum, provavelmente não é viável. Especialmente se você publica um episódio todos os dias ou quase todos os dias. É aí que entram os de-essers.
Os de-essers são ferramentas de processamento desenvolvidas especificamente para eliminar as frequências agressivas que criam sibilância. Normalmente vêm na forma de plug-ins, e muitas DAWs já incluem um de-esser pronto para uso. Eles também existem em formatos de hardware, em channel strips ou, como no caso do RØDECaster Pro, como recurso integrado em um console.
Um de-esser é essencialmente um compressor que reduz o volume de determinada faixa de frequências sempre que ela é detectada. Dependendo do tipo utilizado, você poderá controlar parâmetros como a frequência de corte (que determina qual frequência aciona o de-esser), quanto a frequência é reduzida (geralmente indicado como “amount” ou “depth”), quanto ganho pode passar antes que o de-esser seja acionado (geralmente chamado de “threshold”), a velocidade com que o de-esser é acionado (“sensitivity”) e muito mais.

O DigitalFishPhones SpitFish é um de-esser gratuito e simples. Você pode ajustar o ponto de corte da frequência em qualquer lugar entre 4 e 12 kHz.
Usando um de-esser
Normalmente, os de-essers são ferramentas do tipo “configure e deixe”. Se você está acostumado a gravar sua própria voz, provavelmente sabe onde ocorre a sibilância, o que significa que pode definir o ponto de corte onde necessário e esquecê-lo. Se o seu podcast apresenta convidados regularmente, talvez você queira lidar com a sibilância na pós-produção. Esse processo consiste em localizar o pico sibilante mais agressivo da gravação e definir ali o corte de frequência. Não é um processo muito complicado e pode fazer uma enorme diferença na qualidade geral do seu podcast.
Compressão
A compressão é outro desses processos de áudio onipresentes, usados em todos os aspectos da produção de áudio. É um tema amplo que poderia muito bem ter seu próprio artigo (ou livro), portanto, a seguir falaremos especificamente sobre o uso da compressão na gravação de voz.
O que é?
Em essência, os compressores reduzem a faixa dinâmica de um sinal de áudio, reduzindo as partes mais altas e aumentando as partes mais baixas. Em geral, são usados para fazer uma gravação soar mais clara, mais alta e mais natural sem adicionar distorção e, por isso, são uma ferramenta essencial para engenheiros de áudio de todas as áreas. Dito isso, podem ser usados em excesso ou incorretamente e arruinar rapidamente uma gravação.
Ao gravar voz para um podcast, adicionar compressão pode fazer uma gravação soar encorpada, refinada e profissional. No entanto, uma compressão intensa pode fazer a voz soar sem vida e artificial. Geralmente é um efeito sutil, mas pode ser facilmente exagerado, por isso é importante compreender os controles básicos e o que eles fazem.

O plug-in Compressor do Logic Pro X possui controles de threshold, ratio, gain, attack, release e knee – tudo de que você precisa para moldar o som da sua voz e muito mais.
Controles comuns de compressão
Os compressores normalmente têm o mesmo conjunto de parâmetros ajustáveis, mas, dependendo do nível de complexidade do efeito utilizado, alguns podem estar ausentes (predefinidos ou não incorporados) ou pode haver mais controles disponíveis.
Estes são os parâmetros comuns que você encontrará em um compressor:
Threshold – O volume (dB) no qual o compressor é acionado. Um threshold mais baixo resultará em um efeito sutil ou, se for baixo demais, talvez o efeito nem seja perceptível. Se for definido alto demais, o sinal soará excessivamente comprimido e “achatado”.
Ratio – Quanto o volume do sinal é reduzido em comparação com o volume de entrada. Isso é expresso no formato [X = volume de saída]:[Y = volume de entrada] – por exemplo, se a proporção for 2:1, o volume de saída será duas vezes mais baixo que o volume de entrada. Ao gravar vozes para um podcast, geralmente você deverá trabalhar entre 2:1 e 4:1.
Input Level – O nível do sinal enviado ao compressor.
Output Gain – Como a compressão é essencialmente um processo de redução de ganho, talvez seja necessário aumentar o sinal de saída para que ele volte ao nível que tinha quando foi enviado ao compressor. Isso às vezes é chamado de “makeup gain”. Normalmente, você deve garantir que o nível de saída corresponda ao nível de entrada (a maioria dos compressores possui medidores de nível lado a lado para facilitar a comparação).
Attack – O tempo que o compressor leva para começar a reduzir o ganho depois que o sinal ultrapassa o threshold. Ao gravar vozes, você deverá definir um attack bastante rápido para evitar um som artificial.
Release – O tempo que o compressor leva para parar de reduzir o ganho depois que o sinal ultrapassa o threshold. Se for rápido ou lento demais, pode fazer uma gravação vocal soar estranha, então procure um bom equilíbrio.
Knee – O quão suave é a transição entre o sinal comprimido e o não comprimido. Isso não terá um impacto enorme na sua gravação vocal, mas quanto mais alto for o knee, mais suave será a transição, resultando em um efeito mais sutil e suave, e vice-versa. Um soft knee funciona bem para vozes.
Noise Gate
Em um mundo ideal, todo podcaster teria um espaço confortável e profissional para trabalhar, com isolamento acústico de nível de estúdio, os melhores equipamentos que o dinheiro pode comprar e chá e café à disposição. Mas, como você bem sabe, esse geralmente não é o caso.
Em comparação com o rádio, o podcasting é, de muitas maneiras, uma atividade amadora – qualquer pessoa pode fazê-lo, mesmo com os equipamentos mais básicos. E essa é a sua magia. Mas isso também significa que muitos de vocês trabalham em espaços longe do ideal, com tudo, desde o ruído do trânsito e a reverberação do piso até colegas de casa falando ao telefone, ameaçando arruinar sua gravação. Como lidar com todo esse ruído de fundo indesejado?
Há algumas medidas fundamentais que você pode tomar para ajudar, e abordamos isso em nosso artigo Como obter a melhor qualidade de áudio do seu podcast . Mas e na pré e na pós-produção? Usar um noise gate é uma solução simples e eficaz.

O plug-in Noise Gate do Logic Pro X possui controles de threshold, attack, hold, release e redução de nível, além de parâmetros de sidechain, úteis para efeitos de ducking (falaremos mais sobre isso em breve).
O que é um noise gate e como usá-lo?
Um noise gate é um processador dinâmico que controla o conteúdo de um sinal de áudio com base no volume do que está sendo gravado. Parente dos compressores e de-essers, os noise gates são frequentemente usados para remover ruídos indesejados de uma gravação, definindo um threshold de ganho abaixo do qual tudo é removido ou tem o volume reduzido.
Pense no threshold literalmente como um portão: se você definir o threshold em -40 dB, qualquer coisa mais alta que isso poderá passar; no entanto, para tudo que for mais baixo, o portão se fecha. Percebe como isso pode ser útil para reduzir o ruído de fundo?
Os controles de um noise gate são semelhantes aos de um compressor:
Threshold – Define o nível (dB) no qual o gate se fecha.
Attack – A velocidade (ms) com que o gate se fecha depois de ser acionado.
Hold – O tempo (ms) durante o qual o gate permanece fechado.
Release – A velocidade (ms) com que o gate se abre depois que o threshold é atingido novamente.
Range (também chamado de floor ou redução de nível) – Controla quanto do sinal passa pelo gate depois que ele se fecha. Se for definido como zero, nenhum som passará; à medida que você aumenta o valor, cada vez mais som passará; no máximo, o gate fica essencialmente aberto. Esse controle pode ser útil se você não quiser eliminar completamente o ruído de fundo, mas apenas reduzi-lo, fazendo sua gravação soar um pouco mais natural.
Ducking
Ducking – também conhecido como compressão sidechain – é um efeito usado em todos os tipos de produção de áudio, de EDM à transmissão de rádio.
Em poucas palavras, o ducking reduz o nível de um sinal de áudio quando ele está na presença de outro sinal de áudio. Em podcasts, é uma ferramenta extremamente útil para garantir que a voz do apresentador esteja sempre mais presente que a dos convidados e é particularmente útil para controlar entrevistados agitados ou dominantes.
Configurar a compressão sidechain é um processo relativamente complexo que envolve inserir um noise gate no(s) canal(is) que você deseja “abaixar” e enviar o sidechain do gate para a faixa que você quer usar para controlar as outras (ou seja, a do apresentador). Nem todos os noise gates têm essa funcionalidade.
O RØDECaster Pro, por outro lado, possui uma prática ferramenta de ducking pré-carregada em seu poderoso processador de efeitos integrado, pronta para uso com o toque de uma chave. Prático!
O RØDECaster Pro: uma solução completa para podcasts
Na verdade, todo o processamento e os efeitos de áudio mencionados acima estão integrados ao RØDECaster Pro, o único console do tipo a oferecer uma gama tão ampla de recursos prontos para podcasts.
Compressão, de-essing, noise gate e ducking estão disponíveis para cada canal (ducking apenas para o canal 1). Os processadores de áudio APHEX integrados (encontrados nos principais estúdios de transmissão do mundo) oferecem ainda mais clareza e presença vocal encorpada. Também há predefinições desenvolvidas especificamente para determinados tipos de voz (grave, média e aguda; suave, média e forte), proporcionando a qualidade de transmissão que você procura. É realmente a produção profissional de podcasts simplificada. Saiba mais aqui.