// LINUX-MAGAZIN — LINUX & OPEN SOURCE
Jive Vocals: Podcast-Ton auf Knopfdruck
Abbildung 1: Martin Wimpress stellt Jivetalking beim Ubuntu Summit 26.04 vor. Bild: Marius Quabeck
Martin Wimpress brauchte für seinen Podcast einen Toningenieur und hatte keinen. Also hat er einen in Go geschrieben. Jive Vocals hieß bis zum Sommer noch Jivetalking. Das Programm bringt rohe Mikrofonspuren mit einem Befehl auf -16 LUFS und verlangt keine Konfiguration. Ich setze das Werkzeug seit Februar 2026 in meiner eigenen Podcast-Produktion ein und habe damit ein Programm in Rente geschickt, das mich fast zehn Jahre lang begleitet hat: Levelator.
Als sich der Linux Matters Podcast Ende 2025 auf eigene Füße stellte, fiel auch die bisherige Postproduktion weg. Übrig blieben, in Martins Worten, drei Kerle mit drei verschiedenen Mikrofonen in drei verschiedenen Arbeitszimmern, die drei Aufnahmen von sehr unterschiedlicher Qualität abliefern. Weder Martin Wimpress noch Alan Pope noch Mark Johnson sind Tontechniker, und keiner hatte Lust, einer zu werden. Die technische Aufbereitung der Spuren sollte automatisch laufen, ohne dass sich die drei erst in Tontechnik einarbeiten mussten.
Martin Wimpress hat Ubuntu MATE mitgegründet, bei Canonical als Developer Advocate und Engineering Manager an Snapcraft gearbeitet und später als Director of Engineering den Ubuntu Desktop geleitet. Um 2017 gehörte er außerdem zum Maintainer-Team von Electron, wo er vor allem die Linux-Unterstützung vorantrieb. Heute arbeitet er für das Supply-Chain-Security-Unternehmen Chainguard. Analysesoftware für Flugschreiber hat er ebenfalls schon geschrieben, Messdaten schrecken ihn also nicht. Wie schwer kann es da sein, einen Toningenieur in Software nachzubauen? In einem frühen Rückblick sprach er von „zwei Monaten voller Sonntage“. Bis zum Frühjahr 2026 hatte ihn das Projekt praktisch seine gesamte Freizeit seit Anfang November 2025 gekostet. Martin nennt Jive Vocals das anspruchsvollste Stück Software, das er je geschrieben hat.
Jeder Sprecher nimmt seine Spur lokal auf und exportiert sie als FLAC, dann heißt es jive-vocals mark.flac martin.flac popey.flac. Eine Konfigurationsdatei, Presets oder Regler gibt es nicht. Pro Eingabe entsteht eine Mono-FLAC-Datei mit 44,1 kHz und 16 Bit. Das Programm zielt auf -16 LUFS integrierte Lautheit und eine True-Peak-Obergrenze von -1 dBTP, eine gängige Spezifikation für Sprachpodcasts. Dabei dämpft es Rumpeln, Rauschen, Klicks und scharfe Zischlaute. Daneben liegt ein Markdown-Report mit allen Messwerten und den exakt verwendeten Filterparametern, bewusst ohne Werturteile.
Mehrere Dateien verarbeitet das Programm parallel, für jede Datei läuft eine eigene Zeile im Terminal-Interface mit VU-Meter und Fortschrittsbalken. Am Ende zeigt eine Abschlussbox pro Spur, was passiert ist: Lautheit, True Peak und Dynamik jeweils vorher und nachher, den Noise Floor und zwei Sternebewertungen. „Recording“ benotet die Aufnahme, die man geliefert hat, nach den Kriterien Sauberkeit, Headroom und Pegel. „Processed“ benotet das Ergebnis gegen die Zielspezifikation und landet fast immer bei fünf Sternen, weil das schlicht der Job des Werkzeugs ist. Die interessante Zahl ist die erste: Sie sagt, ob man beim nächsten Mal leiser aussteuern, den Raum dämpfen oder das Mikrofon näher heranholen sollte.
Auf meinem MiniBook-X dauerte die Verarbeitung von drei halbstündigen Aufnahmen knapp 28 Minuten. Trotz der sehr unterschiedlichen Aufnahmepegel lagen alle drei Ergebnisse höchstens 0,1 LU vom Zielwert -16 LUFS entfernt.
Mit -a lässt sich eine Aufnahme vorab prüfen. Es entsteht keine neue Audiodatei; das Programm schreibt einen Analysebericht und zeigt eine fünfstufige Balkenanzeige, die den Eingangs-True-Peak mit dem Ziel von -6 dBTP vergleicht. Die Farben reichen von Cyan für zu leise über Grün bis Rot für Übersteuerung. Dazu kommt ein Ratschlag, etwa „Hot. Peaks at -0.1 dBTP. Lower input gain ~6 dB“. So kann ich den Aufnahmepegel vor dem nächsten Take korrigieren. Mit --diagnostics schreibt Jive Vocals zusätzlich Vorher-Nachher-Spektr