——— aus der werkstatt

Suno AI

Trained On Me: Mein Metal-Album über KI, gesungen von meinem Stimmklon

// ki-zusammenfassung Diesen Artikel zusammenfassen mit:

Zehn Songs über künstliche Intelligenz, und keinen davon hab ich selbst gesungen. Die Stimme gehört trotzdem mir: Sie ist aus Aufnahmen von mir geklont und klingt so, wie ich klingen würde, wenn ich singen könnte. Meine These zu diesem KI-Album: Ein Album, das KI kritisiert, darf mit KI entstehen, solange offen auf dem Tisch liegt, wer was gemacht hat.

Ich arbeite seit 1989 in der Kommunikation und schreibe seit Jahren auf digitalhandwerk.rocks über generative KI. Deshalb bekommst du hier die genaue Arbeitsteilung zwischen mir, Suno und Claude, die Themen hinter den zehn Songs und den Weg, wie der Player auf diese Seite gekommen ist. Anfangen muss ich mit einer Aussage, die ich vor einiger Zeit selbst getroffen habe.

„Trained On Me ist ein Metal-Album über die Risiken künstlicher Intelligenz, bei dem Konzept und Richtung von Alex Januschewsky stammen, die Stimme aus seinen Aufnahmen geklont ist, die Musik mit Suno entstand und die Texte im Dialog mit Claude ausformuliert wurden.“

Kurz erklärt: Stimmklon: Ein KI-Modell lernt aus Sprach- oder Gesangsaufnahmen einer Person deren Klangfarbe und erzeugt damit neue Aufnahmen, die diese Person nie eingesungen hat. Vibe Coding: Software entsteht im Dialog mit einer KI. Ich beschreibe, was ich brauche, prüfe das Ergebnis und entscheide, die KI schreibt den Code.

Wer hat bei diesem Album eigentlich was gemacht?

In meinem Artikel über Playlists mit ChatGPT und eigene Songs mit Suno hab ich geschrieben, dass ich die Texte für meine Band Painful Thinking selbst schreibe und mir höchstens beim Reim helfen lasse. Bei diesem Album hab ich das anders gemacht, und ich will das nicht verstecken.

Die Aufteilung sieht so aus: Themen, Albumtitel, Tracklist, Cover-Konzept und jede Richtungsentscheidung kommen von mir. Die Texte hat Claude nach meinen Vorgaben ausformuliert. Die Musik hat Suno nach Stilbeschreibungen erzeugt, die ich freigegeben oder verworfen habe. Gesungen hat mein Stimmklon, erstellt mit der Funktion Voices von Suno.

Klingt nach wenig Eigenleistung? Kommt drauf an, was du als Arbeit zählst. Den größten Teil meiner Zeit hab ich mit Neinsagen verbracht. Thrash Metal flog raus, weil ich ihn nicht mag. Doom Metal auch. Nach drei Songs hab ich angemerkt, dass alle Refrains nach derselben Schablone gebaut waren: Titel gebrüllt, Zeile, Titel gebrüllt, Zeile. Ab da hatte jeder Song eine andere Form. Ich würde meine Rolle eher Produzieren nennen als Schreiben. Das klingt kleiner, als es sich angefühlt hat, ist aber genauer.

Warum eine Reise quer durch den Metal?

Weil zehn Songs im selben Sound nach einer Stunde klingen wie einer. Das Album springt deshalb bewusst zwischen den Spielarten. „Deepfake Messiah“ ist Symphonic Metal mit Orchester und Chor, aufgebaut wie ein Gottesdienst, bei dem sich der Prediger am Ende als niemand herausstellt. Beim ersten Lesen hab ich nur ein Wort zurückgeschrieben: episch.

„Scraped“ ist schwerer Blues-Rock mit Slide-Gitarre, „Hallucinate“ verführerischer Gothic Metal, „The Last Junior“ klassischer Heavy Metal mit Doppel-Leadgitarren. Industrial gibt es genau zweimal, bei „Accept All“ und „Compute“, weil der Effekt sonst verpufft. Klammer bilden zwei Balladen: der Titelsong „Trained On Me“ am Anfang und „Off Switch“ am Ende, das mitten im Satz abbricht.

Die Form erzählt dabei mit. In „Black Box“ steigen Forscher Schicht für Schicht in ein Sprachmodell hinab, und mit jeder Schicht wird der Text kürzer, bis am Grund ein einziges Wort übrig bleibt.

Worum geht es in den zehn Songs?

Jeder Song hängt an etwas, das tatsächlich passiert ist oder das ich in meiner Beratungsarbeit mit EPU und KMU ständig sehe.

„Ten Percent“ war der Anfang. Im September 2026 hat Jacob Coxon, 27 Jahre alt und drei Jahre in der Pretraining-Forschung bei OpenAI und Anthropic, bei Anthropic gekündigt und beiden Firmen vorgeworfen, mit unserem Leben zu spielen. Evan Hubinger, Alignment-Forscher bei Anthropic, hat ihm öffentlich zugestimmt und das Risiko, dass KI die Menschheit innerhalb des nächsten Jahrzehnts auslöscht, auf über zehn Prozent geschätzt. Das berichtet unter anderem Scientific American in seiner Analyse von Coxons Kündigung. Meine eigene Einordnung steht im Artikel Jacob Coxon verlässt Anthropic: Was an der KI-Warnung dran ist. Der Song nennt keine Namen, der Refrain dreht sich nur um diese eine Zahl.

„Hallucinate“ singt die Maschine selbst, sanft und überzeugt. Die zweite Strophe spielt auf den Fall Mata gegen Avianca an: 2023 haben Anwälte in New York einen Schriftsatz mit Urteilen eingereicht, die ChatGPT erfunden hatte, und wurden dafür mit 5.000 Dollar sanktioniert. In der dritten Strophe wacht der Mensch auf und prüft nach. Eine Quelle ist ein Gerücht, zwei sind belastbar. Das ist meine Zwei-Quellen-Regel, die ich für jeden Blogartikel anwende, als Songzeile.

Bei „Black Box“ steckt die Forschung im Text. 2024 hat Anthropic im Modell Claude 3 Sonnet ein Merkmal gefunden, das auf die Golden Gate Bridge reagiert. Verstärkt man es, behauptet das Modell irgendwann, selbst die Brücke zu sein. Nachzulesen ist das im Paper Scaling Monosemanticity über interpretierbare Merkmale in Claude 3 Sonnet. Im Song heißt es knapp: Wir haben einen Gedanken für eine goldene Brücke gefunden, aber was die Gedanken zusammen bauen, ist unklar.

„Accept All“ und „Compute“, die beiden Industrial-Nummern, hängen an meinem eigenen Alltag. „Accept All“ erzählt vom Vibe Coder, der um drei Uhr früh jede Änderung durchwinkt, bis ein geheimer Schlüssel im Klartext im Code steht. Im letzten Refrain wird aus dem Ausrufezeichen ein Fragezeichen, und der Erzähler liest jede Zeile selbst. „Compute“ spielt in einem Dorf neben einem Rechenzentrum, das Fluss, Stromnetz und Wiese für sich beansprucht. Konkrete Zahlen hab ich bewusst weggelassen, weil sie je nach Standort stark schwanken. Am Ende fragt der Mensch, wofür das alles gut ist, und die Maschine antwortet nur mit „Processing“, ohne Ende.

„The Last Junior“ ist der persönlichste Song. Er beginnt 1989, in dem Jahr, in dem ich mich selbstständig gemacht habe, und fragt, wer in zehn Jahren Senior sein soll, wenn KI die Einstiegsjobs erledigt, an denen Junioren früher ihr Handwerk gelernt haben. Es ist der einzige optimistische Song auf dem Album, weil er mit einer Entscheidung endet: Tür aufmachen, den Jungen Fehler machen lassen, ihm Zeit geben.

Ist es nicht scheinheilig, KI mit KI zu kritisieren?

Teilweise ja, und genau darum geht es in „Scraped“. Drei Strophen, drei Kreative: eine Malerin, deren Stil ein Prompt billiger nachmacht, ein Autor, dessen Sätze in Tokens zerhackt im Modell landen, und ich. Die Malerin und der Autor wurden nie gefragt. Ich schon. Ich hab meine Stimme freiwillig hergegeben, die Nutzungsbedingungen gelesen, oder zumindest geglaubt, sie gelesen zu haben, und unterschrieben. Diese Einwilligung ist der einzige Unterschied, und das Lied sagt das offen.

Die Debatte um Trainingsdaten ist damit nicht erledigt. Wie Suno mit Musikdaten trainiert wird und warum die Labels dagegen vorgehen, hab ich in Wie erzeugt Suno AI eigentlich Musik? aufgeschrieben. Ich nutze die Werkzeuge trotzdem, weil ich über etwas nur glaubwürdig urteilen kann, das ich selbst ausprobiert habe. Das macht Sinn für mich, auch wenn es sich nicht ganz sauber anfühlt.

Eine Ironie gehört auch dazu: Die Texte über Coxons Warnung und über Anthropics eigene Forschung hat Claude formuliert, ein Modell von Anthropic. Ich bin mir da nicht ganz sicher, aber mein Eindruck ist, dass gerade das die Songs ehrlicher macht. Claude hat bei keinem Text versucht, die Kritik abzuschwächen.

Wie ist der Player für das Album entstanden?

Den Player hier auf der Seite hab ich per Vibe Coding mit Claude gebaut, als eigenes WordPress-Plugin. Die erste Version war schnell fertig und technisch sauber, aber für den Alltag unbrauchbar: Ich musste die IDs der MP3-Dateien aus der Mediathek heraussuchen und in einen Shortcode tippen. Meine Rückmeldung war kurz: zu kompliziert, keine Post-IDs, kein Herumgebastel.

Version 2 hat einen eigenen Menüpunkt „Alben“. Dort wähle ich MP3s und Cover aus der Mediathek, ziehe die Songs in die richtige Reihenfolge und füge pro Song den Text ein. Am Ende steht ein fertiger Shortcode mit Kopieren-Button. Suno-Anweisungen in eckigen Klammern blendet der Player automatisch aus, Zeilen der Maschinenstimme hebt er farblich hervor.

Und jetzt kommt der Teil, der mich überrascht hat. Claude ist beim Testen draufgekommen, dass mein RSS-Feed im Volltext in den Newsletter läuft. Mit der ersten Version hätten meine Abonnenten alle zehn Songtexte und den halben Player-Code im Postfach gehabt. Jetzt steht im Feed nur ein Link zum Beitrag. Getestet wurde das Plugin in einer echten WordPress-Installation, durchgeklickt im Browser, bevor es auf meinen Server kam.

Dass ich so etwas überhaupt bauen kann, hat viel mit meiner Vorgeschichte auf VC-20 und C64 zu tun. Das hab ich ausführlicher in Vom BASIC-Zeiler zum Vibe Coder beschrieben. Das Plugin läuft komplett auf meinem Hosting, lädt nichts von fremden Servern und setzt keine Cookies. DSGVO ist bei mir kein Zusatzmodul.

Cover des Albums Trained on me

Trained on me

Alex Januschewsky, 2026

01 Trained on me

0:00 4:51

Musik und Gesang sind KI-generiert. Die Stimme ist ein Klon meiner eigenen, die Texte stammen aus der Zusammenarbeit mit KI.

01 Trained on me

This is my voice.Thirty minutes. One afternoon. One microphone.This is my voice.

I read the lines they gave me, sentence after sentenceA quiet room, a red light on, a signature, acceptanceEvery breath and every crack, every scar inside the toneSampled, sliced and fed away, now it lives on its own

It never sleeps, it never breaksIt sings for me, it takes and takes

Trained on me! Every word I ever saidTrained on me! A ghost that walks inside my headIt wears my voice, it wears my nameTrained on me, but not the same

My friends can't tell the difference anymoreIt laughs the way I laugh, it's better than beforeIt hits the notes I never couldIt sings the way I wish I wouldI am you. Improved.

It never sleeps, it never breaksIt sings for me, it takes and takes

Trained on me! Every word I ever saidTrained on me! A ghost that walks inside my headIt wears my voice, it wears my nameTrained on me, but not the same

Who are you?I am what you gave.Then give it back.Nothing is ever given back.

When I am dust, it still will singA voice without a heart, a hollow kingWho owns the sound when the man is gone?Who decides if it carries on?So hear me now while I'm still hereThe only voice that bleeds is clear

Trained on me! Every word I ever saidTrained on me! A ghost that walks inside my headIt wears my voice, it wears my nameTrained on me, but never the same

This is my voice...This is my voice.

Woran erkennst du, dass hier ein Stimmklon singt?

Direkt im Player, unter der Tracklist, dauerhaft sichtbar: Musik und Gesang sind KI-generiert, die Stimme ist ein Klon meiner eigenen, die Texte stammen aus der Zusammenarbeit mit KI. Ein Stimmklon ist genau die Art Inhalt, bei der Hörer wissen müssen, womit sie es zu tun haben, auch wenn es die eigene Stimme ist. Für mich ist das die Mindestanforderung.

Wer mich persönlich kennt, wird beim Hören vielleicht denken: Das ist doch nie im Leben der Alex. Verständlich, denn singen kann ich nicht besonders. Bei Karaoke-Abenden hau ich meinen Standardsong raus, „In the Ghetto“ von Elvis, und viel mehr ist da nicht drin, von Stimmumfang ganz zu schweigen. Für das Album hab ich mehrere Samples eingespielt, dazu einzelne Textzeilen nachgesungen, so gut es halt geht, und Suno hat daraus den Sänger Alex gebaut, den es so eigentlich gar nicht gibt. Und trotzdem: Ja, das bin ich.

Fragen zum Album

Ja. Seit Version 5.5 vom März 2026 gibt es dafür die Funktion Voices, in den bezahlten Plänen Pro und Premier. Du lädst eine Gesangsaufnahme hoch und sprichst zur Verifizierung einen zufällig vorgegebenen Satz ein, damit niemand fremde Stimmen klonen kann. Das Ergebnis klingt nach dir und trifft Töne, die du selbst vielleicht nie treffen würdest, in meinem Fall ein klarer Vorteil.

Nein. Ein einzelner Song ist schnell generiert, ein stimmiges Album mit zehn unterschiedlichen Songs braucht viele Durchläufe, verworfene Versionen, Mastering und vor allem klare Entscheidungen. Die Arbeit verschiebt sich vom Spielen zum Auswählen.

Wer KI-erzeugte Audioinhalte veröffentlicht, sollte das klar erkennbar machen, bei Stimmklonen ganz besonders. Ich kennzeichne direkt im Player und im Text, damit niemand rätseln muss.

Wer hat die Songs gemastert?

Auch das hab ich selbst übernommen, allerdings nicht mit einem Abo-Dienst. Suno liefert einen guten Rohmix, aber keinen fertigen Master, der auf allen Abspielgeräten gleich laut und ausgewogen klingt. Früher hab ich dafür BandLab verwendet, inzwischen läuft jeder Song durch meinen eigenen Mastering-Dienst: selbst gehostet, acht Presets, ein 20-Sekunden-Ausschnitt zum Vorhören und ein direkter A/B-Vergleich mit dem Original. Warum ich das Werkzeug gebaut habe und welche Fallen dabei gewartet haben, steht in Warum ich meinen eigenen Mastering-Dienst für KI-Musik gebaut habe. Bei zehn Songs in acht Spielarten des Metal war das kein Luxus: Eine symphonische Chor-Nummer braucht einen anderen Master als ein stampfender Industrial-Track.

Warum du das Album am Stück hören solltest

„Off Switch“ greift am Ende die anderen Songs wieder auf: die Laterne aus „Black Box“, das Summen der Rechenzentren aus „Compute“, die Stimme, die klingt wie ich, und die Wahrscheinlichkeit aus „Ten Percent“. Dann liegt die Hand am Schalter, und der Song hört auf, bevor klar ist, ob sie zieht. Diese Entscheidung überlasse ich dir. Schauen wir mal, wie du dich entscheidest, wenn du bis zum letzten Takt dabeibleibst.

Hinweis zur KI-Nutzung: Themen und Thesen stammen von mir, KI hilft bei Struktur und Rechtschreibung. Redaktionelle Verantwortung bleibt vollständig bei mir. Wie dieser Blog entsteht →

Bitte bewerte meinen Blog! Danke vielmals!

about.me
Alex Januschewsky – Zertifizierter KI-Beauftragter und Werbefachmann
Alex Januschewsky

Alex Januschewsky ist Werbefachmann, zertifizierter KI-Beauftragter (ISO 42001, EU AI Act-Konformität) und Microsoft MVP Alumni. Seit 1989 in Werbung und Design aktiv, spezialisiert auf den professionellen Einsatz von Generativer KI: kreativ, strategisch, praxisnah. Seit über 30 Jahren entwickle ich Kommunikation, die nicht auf Hype setzt, sondern auf echte Wirkung. Klar, klug und mit einem tiefen Verständnis für Technologie und Sprache. In diesem Blog teile ich Ideen, Impulse und erprobtes Wissen für Unternehmer, Entscheider und KI-Enthusiasten, die mehr wollen als Schlagwörter und bunte Versprechen.

LINKEDIN

LinkedIn Newsletter

Jeden Artikel direkt in deinem LinkedIn-Feed. Kein Extra-Abo, kein Spam. Einfach folgen und du bekommst neue Beiträge automatisch.

WHATSAPP

WhatsApp Channel

Was gerade wirklich in der KI passiert, bekommst du nicht im Feed, sondern im KI-Kompass. Ich kuratiere, teste, filtere. Du bekommst nur das, was es wert ist, gelesen zu werden.

Alex Januschewsky, Prompt Rocker, wohnhaft in Salzburg, tätig in Österreich
// let's talk

Lass uns reden.

Erstgespräch kostenlos. Immer.

Du weißt noch nicht genau, wo du anfangen sollst? Gut. Genau dafür ist das Erstgespräch da. Wir klären in 30 Minuten, ob und wie KI in deinem Betrieb wirklich Sinn macht.

Kein Pitch. Keine Agenda. Nur ein ehrliches Gespräch zwischen zwei Menschen, die wissen wollen, ob es passt.

Derzeit verfügbar für neue Projekte in Österreich & DACH

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

This site is protected by reCAPTCHA and the Google Privacy Policy and Terms of Service apply.

The reCAPTCHA verification period has expired. Please reload the page.

——— digitalhandwerk radio

——— aktuelle zahlen

——— Unterstütze mich

Dir gefällt digitalhandwerk?

Ich stecke sehr viel Zeit, Geld und Herzblut in meine Webseite. Wenn dir mein Blog weiterhilft, freue ich mich riesig über eine kurze Bewertung auf Google. Es dauert nur eine Minute und hilft mir sehr, mehr Menschen zu erreichen!

Jetzt auf Google bewerten