Acht Presets, ein 20-Sekunden-Ausschnitt zum Vorhören, ein Login-Bildschirm. Genau so sieht mein Mastering-Werkzeug jetzt aus, seit ich mein Webradio wieder ernsthaft mit Musik befülle. Suno 5.5 liefert einen guten Rohmix, das war nie das Problem. Das Problem war immer das, was danach kommt.
Meine These: Wer KI-Musik in Serie produziert, braucht kein SaaS-Abo für den letzten Schritt, sondern ein eigenes, schlankes Werkzeug, das genau die acht Klangwelten abdeckt, die er wirklich braucht, und sonst nichts. Nach diesem Artikel weißt du, warum ich BandLab gekündigt habe, was beim Bauen eines eigenen Mastering-Tools an Fallen wartet, die dir kein Tutorial zeigt, und warum die Signalkette am Ende komplizierter wurde, als ich anfangs gedacht hab. Fangen wir bei der Musik an, nicht beim Code.
Warum ich wieder mehr KI-Musik brauche
Mein Webradio radio.digitalhandwerk.rocks läuft seit einiger Zeit im Vollbetrieb, mit einem KI-Moderator, der durch mein Programm führt, KI-generierte Interviews und mit Songs aus meinem eigenen Suno-Bestand dazwischen. Rock, New Rock, hin und wieder eine italienische Schmalzballade. Damit das Radio nicht nach ein paar Tagen im Loop hängt, brauche ich laufend Nachschub, und das heißt: mehr Songs aus Suno 5.5, die alle noch einmal durch einen Mastering-Schritt müssen, bevor sie auf Sendung gehen.
Suno macht seit Version 5 einen richtig guten Job. Klar, präsent, mit Vocals, die man nicht mehr auf den ersten Ton als synthetisch erkennt. Trotzdem kommt aus Suno kein fertiger Master. Was rauskommt, ist ein solider Mixdown, aber eben keine Datei, die auf allen Abspielgeräten gleich laut und gleich ausgewogen klingt. Genau dafür ist Mastering da: der letzte Schritt, der aus einem guten Mix ein fertiges, überall funktionierendes Stück macht.
Vom kostenlosen BandLab zum gekündigten Pro-Abo
Früher hab ich das in BandLab gemacht. Kostenlose Online-Mastering-Funktion, ein Preset zur Auswahl, unbegrenzt viele Tracks unter 15 Minuten. Für den Einstieg war das völlig ausreichend, ich hab damit sogar meinen ersten KI-Rocksong veredelt. Irgendwann hab ich mir dann die Pro-Version geholt, weil ich mehr aus den Presets rausholen wollte. Das Ergebnis: Ich hab sie kaum genutzt. Zu viel Funktionsumfang für das, was ich tatsächlich brauchte, nämlich Lautheit angleichen, dezent sättigen, sanft limitieren. Also hab ich gekündigt.
Was dann übrig blieb, war eine Lücke. Kostenloses BandLab hätte weiter gereicht, aber ich wollte nicht wieder in ein Abo einsteigen, das ich am Ende doch nur zu einem Bruchteil nutze. Und weil ich sowieso gerade mit Claude Code an technischen Projekten dran bin, hab ich mir die Frage gestellt, die sich eigentlich immer stellt, wenn ein Werkzeug zu groß für die eigene Aufgabe ist: Was, wenn ich genau das baue, was ich brauche, und nichts von dem, was ich nicht brauche?
Was das eigene Tool tatsächlich kann
Am 10. September 2026 stand die erste funktionierende Version. Ein selbst gehosteter Mastering-Webdienst, single-user, passwortgeschützt, ohne Datenbank, ein einzelner Docker-Container auf Coolify. Der Ablauf ist bewusst simpel gehalten: WAV hochladen, eines von acht Presets wählen, auf einem 20-Sekunden-Ausschnitt vorhören, gegen das Original A/B vergleichen, dann als WAV, MP3 mit 192 kbps oder als 5.1-Upmix exportieren.
Die acht Presets decken das ab, was ich für mein Radio tatsächlich brauche: Universal als Bezugspunkt bei minus 14 LUFS, Fire für die lauten, präsenten Rocksongs bei minus 9, Clarity mit mehr Luft oben und einem De-Esser, Tape warm und dunkel mit Sättigung, Natural mit kaum Kompression für ruhigere Stücke, Spatial mit Mid/Side-Verbreiterung, Cinematic mit Sub-Bass und langem Raum, und Punch für alles, was von den Transienten lebt. Dazu drei Intensitätsstufen, Light, Normal und Heavy, die EQ, Sättigung, Breite und Transienten mit den Faktoren 0,6, 1,0 und 1,4 skalieren.

Technisch steckt Python 3.12 mit FastAPI dahinter, Pedalboard von Spotify für die DSP-Bausteine, pyloudnorm für die Lautheitsmessung nach EBU R128, scipy und numpy für alles, was Pedalboard nicht mitbringt, und ffmpeg für MP3 und den Upmix. Das Frontend ist reines HTML, CSS und JavaScript, ohne Framework, weil ich für ein Werkzeug mit einem einzigen Nutzer keinen Build-Prozess brauche. Design und Farben hab ich eins zu eins von digitalhandwerk.rocks übernommen, Amber als Akzent, dunkler Grund, Inter Tight für Text. Bewusst ohne Menü, ohne Header, ohne Impressum. Es ist ein Werkzeug, keine Website.
Wo die eigentliche Arbeit lag
Was ich unterschätzt hab, war nicht das Grundgerüst, sondern die Kleinigkeiten, die erst beim Nachmessen sichtbar werden. Pedalboards Limiter zum Beispiel hält sein eingestelltes Ceiling schlicht nicht ein. Ich hab nachgemessen: Threshold auf minus 6 dB gesetzt, Ausgang trotzdem exakt bei 0,00 dBFS, weil intern Makeup-Gain draufgerechnet wird. Also brauchte es einen eigenen Lookahead-Limiter, der die nötige Absenkung auf einem vierfach oversampelten Signal bestimmt und die Wirkung per Minimum-Filter um den Peak ausdehnt.
Ähnlich überraschend: Pedalboards Compressor erhöht bei den Zeitkonstanten, die ich für Musik brauche, den Crest-Faktor, statt ihn zu senken, von 13,6 auf 21,6 dB. Bei 15 Millisekunden Attack rutscht jede Transiente einfach durch, komprimiert wird nur der Körper des Signals. Die eigentliche Verdichtung übernimmt am Ende also allein der Limiter, für alle acht Presets gleich.
Auch beim Vorhören gab es eine Falle, die ich erst spät bemerkt hab. Der A/B-Abgleich rechnete den Lautheitsunterschied zwischen den Presets versehentlich weg, weil die Angleichung aus dem jeweiligen Zwischenergebnis abgeleitet wurde. Damit landeten Fire bei minus 9 LUFS und Natural bei minus 17 LUFS beim Vorhören auf demselben gefühlten Pegel, was das ganze Vergleichen sinnlos gemacht hat. Jetzt kommt die Referenz für das Vorhören aus einem festen Wert, im A/B des fertigen Songs weiterhin aus dem tatsächlichen Master.
Und dann war da noch die Erkenntnis, dass laut und knackig gleichzeitig nicht funktioniert. Punch sollte ursprünglich auf minus 12 LUFS zielen, aber genau bei diesem Pegel holte der Limiter die Transienten wieder herunter, die das Preset eigentlich betonen soll. Gemessen war Punch am Ende weniger knackig als das neutrale Universal-Preset. Die Lösung war simpel, aber nicht offensichtlich: das Ziel auf minus 14,5 LUFS setzen und dem Limiter mehr Spielraum lassen.
Was für den nächsten, der so etwas baut, wichtig ist
Ein paar Lektionen waren mir vorher schlicht nicht bewusst. Sättigung kostet messbar Dynamik, ungefähr 0,6 dB je dB Drive, ab acht dB kippt sie hörbar in Oberwellen-Mulm. Lossy-Formate brauchen mehr Reserve als das reine Preset-Ceiling, weil ein MP3 beim Dekodieren über 0 dBFS hinausschießen kann, deshalb limitiere ich vor MP3 und AAC zusätzlich auf minus 1,5 dBTP. Und ffmpegs AAC-Encoder überschwingt je nach Bitrate unterschiedlich stark und nicht mal monoton, weshalb ich das Ergebnis nach dem Encoden nochmal nachmesse.
Am meisten geschmunzelt hab ich über die Matroska-Falle: Der erste 5.1-Upmix lag als E-AC-3 in einer .mka-Datei, und weder Music.app noch QuickTime konnten die Datei überhaupt öffnen. Apple kennt Matroska schlicht nicht. Jetzt läuft der Upmix als AAC mit 448 kbit/s in einer .m4a-Datei, dem Wert, den Apple selbst für 5.1 verwendet.
Offen ist noch einiges: Der Docker-Build ist nie lokal gegen einen laufenden Docker-Daemon verifiziert worden, getestet ist bislang alles unter Python 3.11, während das Dockerfile schon auf 3.12 läuft. Und für DSGVO-Sauberkeit wäre es besser, die verwendeten Google Fonts selbst zu hosten statt sie extern zu laden. Kleine Punkte, aber genau die Art von Kleinigkeiten, die man vor dem ersten produktiven Einsatz noch abarbeitet.
Was das für die Praxis bedeutet
Für mein Radio heißt das: Ein Song aus Suno rein, ein Preset gewählt, vorgehört, exportiert, fertig für die Playlist. Kein Login in ein fremdes Tool, keine Wartezeit auf ein Abo, das ich sowieso nur teilweise nutze, und ein Werkzeug, das genau die acht Klangwelten liefert, die ich für Rock, New Rock und die italienischen Balladen tatsächlich brauche. Ob sich das für dich lohnt, hängt vom Volumen ab. Wer alle paar Wochen einen Song mastert, ist mit BandLab oder einem vergleichbaren Online-Dienst nach wie vor gut bedient. Wer wie ich laufend Nachschub für ein autonomes Radio braucht, für den zahlt sich ein eigenes, schlankes Werkzeug irgendwann aus, auch wenn der Weg dorthin ein paar Nachmittage mit Pedalboard, ffmpeg und viel Nachmessen kostet.




