KI-Projekt

Ich habe einen Teil meiner Texte durch eine Musik-KI in fertige Songs umwandeln lassen. Ich würde gern meine Beweggründe und die Vorgehensweise hier erläutern, um schließlich auf die fertigen Songs hinzuweisen, die bei Spotify zu hören sind.

KI-Fluch oder Segen?

Man kann einen Hammer dazu benutzen, einen Nagel in die Wand zu hauen oder gar ein ganzes Haus zu zimmern. Man kann mit einem Hammer auch jemandem den Schädel einschlagen. Mit einem Auto kann man Einkäufe transportieren, mit der Familie in Urlaub fahren oder in eine Menschenmenge rasen.

Es liegt weder an dem Hammer noch an dem Auto, welche Art der Verwendung ihnen zuteil wird. Aus diesem Grund ist die KI (Künstliche Intelligenz, eigentlich AI=Artificial Intelligence) weder gut noch böse, sondern einfach nur ein Instrument. Hat man es                       beispielsweise endlich geschafft den Pyramiden in Gizeh gegenüberzustehen und möchte diesen Augenblick fotografisch   dokumentieren, dankt man der KI, die mit einem einzigen Klick alkoholisierte Pauschaltouristen aus dem Motiv retuschiert.

Wer sich daran erinnert, wie in der Fernsehserie „Raumpatrouille (Raumschiff Orion)“ ein Bügeleisen ins Cockpit eingebaut wurde, erfreut sich an den KI-generierten fantastischen Universen in modernen Science Fiction Filmen und Serien. Trotzdem ist die KI auch in meinen Augen aus zwei Gründen extrem gefährlich:

  1. Sie vernichtet Arbeitsplätze. Menschen werden bereits in einigen Bereichen durch eine KI ersetzt, oft mehr schlecht als recht. Chat-Bots sind meist oft nicht in der Lage das Anliegen wirklich nachzuvollziehen und daher dann völlig nutzlos.  Man mag argumentieren, dass z.B. bei der Service-Hotline der Telekom auch menschliche  Mitarbeiter nicht in der Lage sind wirklich etwas auf die Reihe zu bekommen, trotzdem ersetzt eine KI in diesem Bereich bisher nicht annähernd kompetent menschliche Mitarbeiter. Trotzdem lässt es sich nicht verhindern, dass Menschen eingespart und durch Maschinen ersetzt werden – Orwells Prognosen gehen derzeit in Erfüllung.

 

       2. Fake-News: Mit eine KI lassen sich Fotos und Videos auf eine Art manipulieren, bzw. herstellen, die es kaum noch möglich macht               zwischen Original und Fälschung, Wahrhei und Lüge, Fakten oder Fiktion zu unterscheiden. Früher lag ein Fotograf stundenlang                 mit seiner Kamera verborgen im Unterholz, um ein Rehkitz im Morgenlicht zu fotografieren, heutzutage erschafft eine KI solch                     ein Foto in Sekunden. Schlimmer sind jedoch manipulierte Fotos und Filme. Wenn man einer KI sagt:“ Mach mir ein Foto auf dem             Putin und Trump heiraten“, bekommt man genau das geliefert. Und natürlich lässt sich so ziemlich alles auf diese Art faken:                         Ein Bombeneinschlag in einem Mädcheninternat mit 50 zerfetzen Leichen? In einer Minute von der KI glaubhaft als Video                               erzeugt. Das ist beängstigend und gefährlich, auch wenn die KI in vielen Bereichen noch sehr fehlerhaft ist

 

Niemals Texte mit KI

Glücklicherweise habe ich mehr als 45 Jahre als Autor hinter mich gebracht, ohne dass es eine K gab, die Texte bearbeitet oder gar erzeugt. Heute kann ein Programm wie Chat GPT Zeitungsartikel, Gedichte und vermutlich ganze Romane schreiben. Für mich ist das   keine Option, schließlich betrachte ich mich als Schriftsteller und Autor. Ich bezweifle auch, dass momentan eine KI in der Lage ist     wirklich gehaltvolle Gedichte zu schreiben, Melancholie und Ironie an den richtigen Stellen einzubauen usw. Man kann vermutlich mit Versatzstücken Geschichten schreiben lassen, aber es wird (hoffentlich) niemals eine KI geben, die eine Masha Kalecko oder einen Erich Kästner auch nur ansatzweise imitieren könnte.

Musik-KI

Wie es funktioniert:

Ich glaube es war Mitte oder Ende 2024 als ich erstmals ein Youtube-Video über KI-Programme sah, mit denen man als Laie fertige Songs „produzieren“ konnte. Ich habe mich daraufhin etwas eingehender mit dem Programm „Suno“ beschäftigt. Wenn man keinen Songtext hat, kann man – wie bei Chat GPT – eine Beschreibung eingeben, was der Text thematisch enthalten soll und bekommt einen entsprechenden Songtext. Das ist eine Variante, die für mich nicht von Interesse ist. Die Alternative, die ich benutze, ist seinen eigenen fertigen Songtext einzugeben und die Musik-Ki zu beauftragen daraus einen fertigen Song zu machen. Dazu gibt man ein, ob man eine männliche oder weibliche Stimme haben will (es gibt keine Auswahl zwischen speziellen Stimmen, da muss man sich überraschen lassen) und man gibt die Musikrichtung ein, also beispielsweise „Schlager“, „Rock“, „Country“ usw. Man kann hier noch sehr spezifizieren, z.B. die Eingabe einzelner Instrumente prompten usw.

Die Ergebnisse sind erstaunlich, aber bei weitem nicht fehlerfrei. Manchmal werden Zeilen vergessen, falsch gesungen, bestimmte   Worte nicht erkannt. Dann ist der Song verhunzt. Suno hat sich mittlerweile an einer Korrekturfunktion versucht, die nicht wirklich gut funktioniert. Abgesehen von diesen Fehlern, die mehr oder weniger häufig, immer wieder auftauchen, gibt es noch einige andere Hindernisse. Duette lassen sich nur unzureichend erstellen. Zwar kann man eingeben, dass man sowohl männliche wie auch weibliche Stimmen in einem Lied haben will, aber weist man einer bestimmten Strophe zu, ob sie durch eine männliche oder weibliche Stimme gesungen werden soll, funktioniert das meist nicht so wie gewünscht. In früheren Versionen sind die Songs oft mitten im Lied abgebrochen, bei anderen kurzen Songs hat die KI einfach ein paar Strophen wiederholt, um den Song etwas zu strecken.

Eine weitere Schwierigkeit ist das Unterscheiden zwischen deutscher oder englischer Aussprache. Ich habe zum Beispiel einen Text in dem das Wort „global“ mehrmals vorkommt und mal „deutsch“, mal „englisch“ gesungen wird. In dem Song „Ruinen“ verwende ich das Wort Wall und zwar ist ein Burgwall gemeint. Obwohl der ganze Text in deutsch ist wird „Wall“ englisch gesungen. Ich musste „Wall“durch „Mauer“ ersetzen. Der englische Begriff „Agent Orange“ in einem deutschen Text funktionierte nicht, hiermusste ich auf „Napalm“ umschreiben.

Suno wird dennoch laufend verbessert, es soll bald möglich sein sich eine KI erzeugte Stimme zu speichern, so dass man alle Songs dann mit derselben Stimme erstellen kann. In Zukunft soll man auch seine eigene Stimme einsingen und speichern können, so dass sie dann von der KI verwendet werden kann.

Warum ich Suno benutze:

In meiner Kindheit beschränkte sich deutschsprachige Musik überwiegend auf Schlager.  Dann kamen die Liedermacher, mit denen ich damals noch nicht viel anfangen konnte. Reinhard Mey war noch nicht in seiner brillanten Phase, sondern bei der heißen Schlacht am kalten Buffet. Klaus Hoffman gefiel mir stimmlich, textlich war aber vieles sehr schwulstig und gar flach. Konstantin Wecker war         brillant, aber das war halt nicht meine Musik. Die Neue Deutsche Welle war teilweise spannend, aber textlich auch selten eine Offenbarung. Es dauerte sehr lange bis es deutsche Musik gab, die mich sowohl textlich wie auch musikalisch begeistern konnte (Heinz-Rudolf Kunze, Element of Crime, Thees Uhlmann z.B.).

Als ich 1982 begann Songtexte und Gedichte zu schreiben, schrieb ich die Texte, die ich gern von anderen im Radio gehört hätte.  Es dauerte mehr als 10 Jahre bis erstmals ein Text von mir vertont wurde und nach über 40 Jahren sind zwar einige meiner Werke vertont und veröffentlicht worden, aber mit Sicherheit nicht die besten Texte und auch nicht oft auf die Art wie ich es mir gewünscht hätte. Suno schafft all das in Kürze. Ich habe jetzt viele meiner Texte durch die KI vertonen lassen und höre die meisten davon wirklich gern. Was die Vorbehalte gegen die KI betrifft, sehe ich es so: Ich nehme keinem Musiker dadurch Lohn und Brot. Wäre ich Millionär hätte ich mir ein paar Berufsmusiker mieten und sie meine Texte vertonen lassen können. Da ich diese finanzielle Möglichkeit nicht habe,           beraubt Suno in meinem Fall niemanden. Vielmehr habe ich nun eine Menge fertiger Songs, auf die andere Musiker zurückgreifen könnten. Ich biete neben meinen Texten also gleich noch einen musikalischen Vorschlag an, der beweist wie gut der Text zu vertonen ist.

Man wirft der Musik KI vor, sie würde „klauen“. Das sehe ich anders. In dieser KI befinden sich unzählige Stimmen, Gitarrenriffs, Texte, Melodien. Und natürlich kann sich eine Maschine mehr merken als ein Mensch. Tatsächlich aber handelt es sich um Wissen, dass sich eine Person ebenfalls aneignen könnte. Mit Sicherheit haben die meisten Songwriter unzählige Songs anderer Künstler gehört und greifen möglicherweise unbewusst auf dieses Wissen zurück. Die KI tut nichts anderes.

Um meinen Freunden die Möglichkeit zu geben mitzuerleben, wie sich meine Texte in fertige Songs verwandeln, habe ich diese u.a. auf Spotify bereitgestellt. Der Vorteil ist, dass man das Programm kostenfrei benutzen kann, wenn man ab und an Werbeeinblendungen in Kauf nimmt. Wer mag, kann sich nun also ausgiebig mit meiner „Discografie“ beschäftigen. Mittlerweile kann man mittels KI auch     Musikvideos erstellen, hier sind die Möglichkeiten aber noch deutlich eingeschränkter und im professionellen Bereich unglaublich   teuer. Ich habe ein wenig damit experimentiert, da „youtube“ eine Plattform ist, die für Veröffentlichungen gut geeignet ist. Allerdings geht es hauptsächlich darum die Songs zu hören, die dazugehörigen Videos sind nur Beiwerk, damit auch die Augen etwas beschäftigt sind. Es sind also keine professionellen Videos. 

Die KI-Songs

Folgende "Alben" sind auf Spotify und anderen 
Plattformen verfügbar:

Die auf Spotify hochgeladenen Songs, zeigen, was man aus meinen Texten machen kann bzw. machen könnte.

Die neuesten "Produktionen" stehen hier zuerst. Die Texte selbst jedoch sind möglicherweise älter. Einfach hören.

Spotify-Link

Videos 

Spuck gegen den Wind

Jennifer downtown

Schiessen wir es aus, Fritz

Guten Morgen Doofland

Gypsy

Emigranten-Ballade

Flügel aus Blei

Frag mal Marlas Freundin

Im Büttener Feld

Verrückte Moleküle

Grüss mir die Elbbrücken

Ich könnte lügen

Ich hab vergessen wie man fliegt

Blondes Gift

Spätsommer, Schweden

Kerosin

B7

Was noch, Juliane?

Ich bin nicht aus dem Holz aus dem man Helden schnitzt

Bin ich ein Teebeutel, oder was?

Kult

Perlentaucher

Ich hab ein dummes Herz

Für Sophie, Hans und die anderen

Der Anfang vom Ende der Unschuld

Nordnordwest

Die Magd

Rock'n Roll Radio

Eyeliner/Skyliner - Frankfurt, null Uhr zehn

Mandys Mond

Information icon

Wir benötigen Ihre Zustimmung zum Laden der Übersetzungen

Wir nutzen einen Drittanbieter-Service, um den Inhalt der Website zu übersetzen, der möglicherweise Daten über Ihre Aktivitäten sammelt. Bitte überprüfen Sie die Details in der Datenschutzerklärung und akzeptieren Sie den Dienst, um die Übersetzungen zu sehen.