Ein Leitfaden zu Audiobearbeitung und Effekten für Podcasts

Wenn du deine Lieblingspodcasts hörst: Was zieht dich am meisten in den Bann? Eine fesselnde Geschichte? Die Chemie zwischen den Hosts? Überzeugende Recherche? Diese Elemente sind zweifellos wichtig für einen großartigen Podcast, doch es gibt eine Sache, die über Erfolg oder Misserfolg einer Sendung entscheiden kann und wohl wichtiger ist als alles andere – die Klangqualität.

Viele Faktoren beeinflussen, wie ein Podcast klingt. Einige davon haben wir bereits in unserem vorherigen Artikel So holst du die beste Audioqualität aus deinem Podcast heraus behandelt. Hier möchten wir uns jedoch speziell auf Audiobearbeitung und Effekte konzentrieren. Die grundlegenden Elemente der Klangproduktion (dein Aufnahmeraum, Mikrofone, Preamps, Mixer und Interfaces usw.) sollten niemals außer Acht gelassen werden – schließlich bilden sie das Fundament jeder großartigen Aufnahme. Audiobearbeitung und Effekte sorgen jedoch dafür, dass ein Podcast glänzt. Alle professionellen Podcaster setzen sie bis zu einem gewissen Grad ein. Im Folgenden sehen wir uns die gängigsten und für die Podcast-Produktion relevantesten an.

EQ

Die Grundlagen

Kurz gesagt ist die Entzerrung – oder EQ – der Prozess, die Lautstärke (dB) bestimmter Frequenzen in einem Audiosignal anzuheben oder abzusenken, um die Gesamtklangfarbe einer Aufnahme zu beeinflussen. Sie gehört zu den allgegenwärtigsten Verfahren der Klangproduktion und ist ein wichtiger Schritt beim Mischen verschiedenster Audiosignale für unterschiedlichste Medien.

Wenn du einen Klang aufnimmst, besteht das Audiosignal aus Schichten verschiedener Frequenzen. Diese liegen in einem Spektrum von 20 Hz bis 20.000 Hz (dem für Menschen hörbaren Bereich). Die tieferen Frequenzen von 20–250 Hz sind Bassfrequenzen; der Mittenbereich – oder „Mids“ – umfasst Frequenzen von 250 Hz bis 4 kHz; die oberen Frequenzen reichen von 4 kHz bis 20 kHz.

Das Anpassen von EQ wirkt sich je nachdem, welche Frequenzen du anhebst oder absenkst, unterschiedlich auf die Klangfarbe des Audios aus, und es gibt unendlich viele Möglichkeiten, ein Signal zu formen. Lass dich davon jedoch nicht abschrecken – es gibt einfache, bewährte Regeln und Equalizer-Typen, mit denen du per Knopfdruck oder durch Drehen eines Reglers eine bestimmte Klangqualität erzielen kannst.

Verschiedene EQ-Arten

Equalizer gibt es in vielen verschiedenen Ausführungen – als Software in deiner Digital Audio Workstation (DAW), als Regler an deinem Mixer oder als Schalter an deinem Mikrofon (du findest sie auch an Gitarren, Gitarrenverstärkern, Beschallungsanlagen, Studio-Hardware wie Preamps und Kompressoren sowie an vielen weiteren Musikinstrumenten und Audiogeräten). Die beim Podcasting am häufigsten verwendeten Equalizer finden sich in DAWs wie ProTools, Logic oder Audacity sowie an Mixern oder Konsolen.

Die meisten einfachen Mixer verfügen pro Kanal über drei EQ Regler – je einen für Bässe, Mitten und Höhen. Manche haben nur einen oder zwei, während fortschrittlichere Konsolen, wie sie in professionellen Studios zu finden sind, möglicherweise mehr bieten. In der Mittelstellung stehen diese Regler auf Unity, das heißt, die Frequenz wird weder angehoben noch abgesenkt. Drehst du sie gegen den Uhrzeigersinn, wird die Frequenz abgesenkt; im Uhrzeigersinn wird sie angehoben. In den meisten Fällen brauchst du beim Podcasting nur diese drei Regler, um deine Stimme nach deinen Vorstellungen zu formen.

Wenn du deinen EQ in einer DAW bearbeitest, stehen dir wahrscheinlich deutlich mehr Optionen zur Verfügung. Alle DAWs werden mit einer Art EQ Software ausgeliefert, und es gibt zahlreiche hervorragende EQs von Drittanbietern, wenn du dafür etwas Geld ausgeben möchtest. Damit kannst du die anzuhebende oder abzusenkende Frequenz äußerst präzise einstellen, Filter hinzufügen, um unerwünschte Frequenzen an bestimmten Grenzpunkten zu begrenzen (Low Shelf, High Shelf, Low Pass und High Pass sind die gängigsten), und Presets verwenden, die speziell für verschiedene Stimmtypen und Anwendungen entwickelt wurden.

Logic Pro X wird standardmäßig mit einem großartigen Channel-EQ -Plug-in geliefert. Hier siehst du ein Preset zum Bereinigen einer Sprachaufnahme. Beachte die Absenkungen im Bereich von 20–250 Hz und die leichten Anhebungen im Bereich von 1–20 kHz. 

Stimmen im Frequenzspektrum

Sprache nimmt im Frequenzspektrum hauptsächlich den Bereich von 85–250 Hz ein und ist damit recht basslastig – hier wirst du beim Podcasting im Allgemeinen deine EQ Anpassungen vornehmen müssen.

Ein Hochpassfilter ist ein effektives Werkzeug, um Stimmen für Podcasts zu formen. Er lässt nur Frequenzen oberhalb eines bestimmten Grenzpunkts passieren und dämpft tiefere Frequenzen. Das Ergebnis ist eine klarere, weniger „wummernde“ Sprachaufnahme.

Vokale, die in der menschlichen Sprache relativ ausgeprägte Laute sind, liegen typischerweise im Bereich von 350 Hz–2 kHz; Konsonanten im Bereich von 1,5 kHz–4 kHz. Wenn dir in deinen Aufnahmen etwas Unerwünschtes auffällt, möchtest du möglicherweise diese Frequenzbereiche anpassen. Zischlaute – die scharfen „S“- und „T“-Laute in Stimmen, die in einer Aufnahme unangenehm hervorstechen – liegen typischerweise im Bereich von 4–7 kHz, daher solltest du auch hier Anpassungen vornehmen. Sei jedoch vorsichtig: In diesem oberen Frequenzbereich erhält deine Stimme ihren Glanz – es ist ein empfindlicher Bereich, den du nicht zu stark beschneiden solltest. Zum Glück gibt es Werkzeuge, die dabei helfen, Zischlaute zu bändigen. Damit kommen wir zu …

De-Essing

De-Essing bezeichnet den Prozess, Zischlaute in einer Aufnahme zu reduzieren. Du kannst dies manuell erledigen – viele Toningenieure schwören darauf und behaupten, dass es natürlicher klingt. Allerdings ist dieses Verfahren zeitaufwendig und für den durchschnittlichen Podcaster wahrscheinlich einfach nicht praktikabel. Besonders dann, wenn du etwa täglich eine Folge veröffentlichst. Hier kommen De-Esser ins Spiel.

De-Esser sind speziell entwickelte Audioprozessoren, die scharfe Frequenzen beseitigen, welche Zischlaute erzeugen. Meistens sind sie als Plug-ins ausgeführt, und viele DAWs werden standardmäßig mit einem De-Esser geliefert, der sofort einsatzbereit ist. Es gibt sie auch als Hardware, in Channelstrips oder – wie beim RØDECaster Pro – als integrierte Funktion einer Konsole.

Ein De-Esser ist im Wesentlichen ein Kompressor, der jedes Mal, wenn er erkannt wird, die Lautstärke eines bestimmten Frequenzbands reduziert. Je nach verwendetem Modell kannst du Parameter wie die Grenzfrequenz (sie bestimmt, welche Frequenz den De-Esser auslöst), die Stärke der Absenkung (meist als „Amount“ oder „Depth“ bezeichnet), den Pegel, der passieren darf, bevor der De-Esser ausgelöst wird (meist „Threshold“ genannt), die Geschwindigkeit, mit der der De-Esser ausgelöst wird („Sensitivity“), und weitere Parameter steuern.

Der DigitalFishPhones SpitFish ist ein einfacher, kostenloser De-Esser. Die Grenzfrequenz lässt sich zwischen 4 und 12 kHz einstellen. 

Einen De-Esser verwenden

De-Esser sind normalerweise Werkzeuge nach dem Prinzip „einstellen und vergessen“. Wenn du deine eigene Stimme regelmäßig aufnimmst, weißt du wahrscheinlich, wo Zischlaute auftreten. Du kannst den Grenzpunkt also an der richtigen Stelle einstellen und dich anschließend nicht weiter darum kümmern. Wenn in deinem Podcast regelmäßig Gäste auftreten, möchtest du Zischlaute möglicherweise in der Postproduktion bearbeiten. Dabei suchst du den schärfsten Zischlaut-Peak in der Aufnahme und stellst dort die Grenzfrequenz ein. Das ist kein besonders komplizierter Prozess und kann die Gesamtqualität deines Podcasts erheblich verbessern.

Kompression

Kompression ist ein weiteres allgegenwärtiges Audioverfahren, das in allen Bereichen der Audioproduktion eingesetzt wird. Es handelt sich um ein umfangreiches Thema, das durchaus einen eigenen Artikel (oder ein eigenes Buch) verdient hätte. Deshalb sprechen wir im Folgenden speziell über den Einsatz von Kompression bei Sprachaufnahmen.

Was ist das?

Kompressoren reduzieren im Wesentlichen den Dynamikumfang eines Audiosignals, indem sie die lautesten Passagen absenken und die leisesten anheben. Sie werden in der Regel eingesetzt, um eine Aufnahme klarer, lauter und natürlicher klingen zu lassen, ohne Verzerrungen hinzuzufügen. Aus diesem Grund sind sie für Toningenieure in allen Bereichen ein unverzichtbares Werkzeug. Allerdings können sie übermäßig oder falsch eingesetzt werden und eine Aufnahme schnell ruinieren.

Beim Aufnehmen von Sprache für einen Podcast kann Kompression eine Aufnahme druckvoll, ausgefeilt und professionell klingen lassen. Starke Kompression kann eine Stimme jedoch leblos und unnatürlich wirken lassen. Es handelt sich im Allgemeinen um einen subtilen Effekt, der aber leicht übertrieben werden kann. Daher ist es wichtig, die grundlegenden Bedienelemente und ihre Funktionen zu verstehen.

Das Compressor-Plug-in von Logic Pro X verfügt über Regler für Threshold, Ratio, Gain, Attack, Release und Knee – alles, was du brauchst, um deinen Stimmklang zu formen, und noch mehr.

Gängige Kompressionsparameter

Kompressoren verfügen normalerweise über denselben Satz einstellbarer Parameter. Je nachdem, wie fortschrittlich der verwendete Effekt ist, können jedoch einige fehlen (entweder als Preset festgelegt oder überhaupt nicht integriert), oder es stehen zusätzliche Bedienelemente zur Verfügung.

Dies sind die gängigen Parameter eines Kompressors:

Threshold – Der Pegel (dB), bei dem der Kompressor ausgelöst wird. Ein niedrigerer Threshold führt zu einem subtilen Effekt; ist er zu niedrig, ist möglicherweise überhaupt kein Effekt wahrnehmbar. Ist er zu hoch eingestellt, klingt das Signal überkomprimiert und „zusammengedrückt“.

Ratio – Gibt an, wie stark der Signalpegel im Verhältnis zum Eingangspegel reduziert wird. Dies wird im Format [X = Ausgangspegel]:[Y = Eingangspegel] angegeben – beträgt das Verhältnis beispielsweise 2:1, ist der Ausgangspegel doppelt so leise wie der Eingangspegel. Bei Sprachaufnahmen für einen Podcast liegt der geeignete Bereich normalerweise zwischen 2:1 und 4:1.

Input Level – Der Pegel des Signals, das in den Kompressor eingespeist wird.

Output Gain ­– Da Kompression im Wesentlichen den Gain reduziert, muss das Ausgangssignal möglicherweise angehoben werden, um wieder den Pegel zu erreichen, den es vor der Einspeisung in den Kompressor hatte. Dies wird manchmal als „Make-up-Gain“ bezeichnet. Normalerweise solltest du darauf achten, dass der Ausgangspegel dem Eingangspegel entspricht (die meisten Kompressoren verfügen über nebeneinander angeordnete Pegelanzeigen, sodass du beide leicht vergleichen kannst).

Attack – Die Zeit, nach der der Kompressor mit der Gain-Reduzierung beginnt, sobald das Signal den Threshold überschreitet. Bei Sprachaufnahmen solltest du eine recht kurze Attack-Zeit einstellen, um einen unnatürlichen Klang zu vermeiden.

Release ­– Die Zeit, nach der der Kompressor die Gain-Reduzierung beendet, sobald das Signal den Threshold wieder unterschreitet. Ist diese Zeit zu kurz oder zu lang, kann eine Sprachaufnahme seltsam klingen. Finde daher einen guten Mittelweg.

Knee – Beschreibt, wie weich der Übergang zwischen komprimiertem und unkomprimiertem Signal ist. Dies hat keinen großen Einfluss auf deine Sprachaufnahme. Je höher der Knee-Wert eingestellt ist, desto weicher ist jedoch der Übergang, was zu einem subtileren, sanfteren Effekt führt – und umgekehrt. Ein Soft Knee eignet sich gut für Stimmen.

Noise Gate

In einer idealen Welt hätte jeder Podcaster einen komfortablen, professionellen Arbeitsraum mit einer Schallisolierung in Studioqualität, dem besten Equipment, das man für Geld kaufen kann, sowie Tee und Kaffee auf Abruf. Aber wie du sehr wohl weißt, ist das häufig nicht der Fall.

Im Vergleich zum Radio ist Podcasting in vielerlei Hinsicht eine Sache für Amateure – jeder kann es machen, sogar mit einfachstem Equipment. Und genau das macht den Reiz aus. Es bedeutet aber auch, dass viele von euch in alles andere als idealen Räumen arbeiten: Verkehrslärm, Hall von den Dielen oder Mitbewohner, die am Telefon sprechen, können eure Aufnahme ruinieren. Wie lässt sich all dieser unerwünschte Hintergrundlärm bewältigen?

Es gibt einige grundlegende Maßnahmen, die helfen können. Wir haben sie in unserem Artikel So holst du die beste Audioqualität aus deinem Podcast heraus behandelt. Aber was ist mit der Pre- und Postproduktion? Der Einsatz eines Noise Gates ist eine einfache und effektive Lösung.

Das Noise-Gate-Plug-in von Logic Pro X verfügt über Regler für Threshold, Attack, Hold, Release und Pegelabsenkung sowie Sidechain-Parameter, die für Ducking-Effekte nützlich sind (dazu später mehr). 

Was ist ein Noise Gate und wie verwendet man es?

Ein Noise Gate ist ein Dynamikprozessor, der den Inhalt eines Audiosignals anhand der Lautstärke des aufgenommenen Signals steuert. Als Verwandte von Kompressoren und De-Essern werden Noise Gates häufig eingesetzt, um unerwünschte Geräusche aus einer Aufnahme zu entfernen. Dazu wird ein Gain-Threshold festgelegt, unterhalb dessen alles entfernt oder in der Lautstärke reduziert wird.

Betrachte den Threshold ganz wörtlich als Tor: Stellst du den Threshold auf -40 dB, darf alles passieren, was lauter ist. Für alles Leisere schließt sich das Gate. Du siehst, wie dies zur Reduzierung von Hintergrundgeräuschen beitragen kann?

Die Bedienelemente eines Noise Gates ähneln denen eines Kompressors:

Threshold – Legt den Pegel (dB) fest, bei dem sich das Gate schließt.

Attack – Die Geschwindigkeit (ms), mit der sich das Gate nach dem Auslösen schließt.

Hold – Die Zeitspanne (ms), während der das Gate geschlossen bleibt.  

Release – Die Geschwindigkeit (ms), mit der sich das Gate öffnet, nachdem der Threshold wieder erreicht wurde.

Range (auch Floor oder Pegelabsenkung genannt) – Steuert, wie viel Signal das Gate im geschlossenen Zustand durchlässt. Ist dieser Wert auf null eingestellt, wird kein Ton durchgelassen. Je höher du ihn einstellst, desto mehr Signal wird durchgelassen; bei voller Aussteuerung ist das Gate im Wesentlichen geöffnet. Dieser Regler kann nützlich sein, wenn du Hintergrundgeräusche nicht vollständig eliminieren, sondern nur reduzieren möchtest, damit deine Aufnahme etwas natürlicher klingt.

Ducking

Ducking – auch als Sidechain-Kompression bezeichnet – ist ein Effekt, der in allen möglichen Bereichen der Audioproduktion eingesetzt wird, von EDM bis zur Radioübertragung.

Kurz gesagt reduziert Ducking den Pegel eines Audiosignals, wenn gleichzeitig ein anderes Audiosignal anliegt. Beim Podcasting ist dies ein äußerst nützliches Werkzeug, um sicherzustellen, dass die Stimme des Hosts stets präsenter ist als die der Gäste. Besonders hilfreich ist es, wenn es darum geht, lebhafte oder übermäßig dominante Interviewpartner im Zaum zu halten.

Das Einrichten einer Sidechain-Kompression ist ein relativ komplexer Prozess. Dazu wird ein Noise Gate auf den Kanal bzw. die Kanäle gelegt, die „geduckt“ werden sollen, und der Sidechain-Eingang des Gates mit der Spur verbunden, die die anderen steuern soll (also beispielsweise mit der Spur des Hosts). Nicht alle Noise Gates verfügen über diese Funktion.

Der RØDECaster Pro hingegen verfügt über ein praktisches Ducking-Tool, das bereits in den leistungsstarken integrierten Effektprozessor geladen ist und per Schalter sofort einsatzbereit ist. Praktisch!

Der RØDECaster Pro: Eine Komplettlösung für Podcasts

Tatsächlich sind alle oben genannten Audiobearbeitungsfunktionen und Effekte im RØDECaster Pro integriert – der einzigen Konsole ihrer Art, die ein derart breites Spektrum podcasttauglicher Funktionen bietet.

Kompression, De-Essing, Noise Gate und Ducking sind für jeden Kanal verfügbar (Ducking nur für Kanal 1). Die integrierten APHEX-Audioprozessoren (wie sie in führenden Rundfunkstudios auf der ganzen Welt zu finden sind) sorgen für zusätzliche Klarheit und eine druckvolle Stimmpräsenz. Außerdem gibt es Presets, die speziell für bestimmte Stimmtypen entwickelt wurden (tief, mittel und hoch; weich, mittel und laut), damit deine Stimme die gewünschte Broadcast-Qualität erhält. Professionelles Podcasting wird damit wirklich einfach. Erfahre hier mehr.