> > Sanremo verbietet KI, aber wie erkennt man, ob ein Lied synthetisch ist?

Sanremo verbietet KI, aber wie erkennt man, ob ein Lied synthetisch ist?

Sanremo verbietet KI, aber wie erkennt man, ob ein Lied synthetisch ist?

(Adnkronos) – Die neuen Regeln des Sanremo-Festivals führen eine neue Bestimmung ein: Künstliche Intelligenz darf den kreativen Beitrag von Autoren und Künstlern weder ersetzen noch verändern. Doch wie lässt sich diese Regel heutzutage umsetzen? Auf einem Lied steht ja nicht „von KI erstellt“. Es kann…

(Adnkronos) – Die neuen Regeln des Sanremo-Festivals führen eine neue Regel ein: Künstliche Intelligenz darf den kreativen Beitrag von Autoren und Künstlern weder ersetzen noch verändern. Doch wie lässt sich diese Regel heutzutage durchsetzen? 

Ein Song wird nicht automatisch mit dem Aufdruck „von einer KI erstellt“ geliefert. Er kann von echten Musikern im Studio eingespielt, von einer App wie Suno in Sekundenschnelle generiert oder in einer Grauzone angesiedelt sein: gesampelte Backing-Tracks, vom Programm vorgeschlagene und abgespielte Arrangements, bis die Melodie zwar vom Algorithmus entworfen, aber von Menschen neu aufgenommen wird.

Die Frage, wer was getan hat, ist zur Aufgabe einer neuen Disziplin geworden: der digitalen Audioforensik oder der Suche nach den Fingerabdrücken, die künstliche Intelligenz in der Musik hinterlassen hat. 

Aurélien Herault, Chief Innovations Officer von Deezer, einer der fortschrittlichsten Musikstreaming-Plattformen, erklärte gegenüber Adnkronos, dass die Systeme bei vollständig computergenerierten Titeln sehr präzise seien. 

„Wenn das Lied das Ergebnis einer Eingabe auf einer generativen KI-Plattform wie Suno ist, sind wir zu 99,8 % sicher, dass wir es als KI identifizieren und sogar die verwendete Version bestimmen können“, sagt Herault.

Das System funktioniert auch bei gemischten Tracks: „Wenn einige Teile eines Tracks ursprünglich von einer Person erstellt wurden, die endgültige Version aber durch eine generative KI-Plattform gerendert wurde, sollten wir dennoch feststellen können, dass KI verwendet wurde.“ 

Die Software von Deezer sucht nach „Artefakten“: mikroskopisch kleinen Audiofehlern, die das Ohr nicht hören kann, die aber von Maschinen unweigerlich in der Datei hinterlassen werden.

„Diese Artefakte sind ein starkes Indiz für die Identifizierung von KI-generierten Spuren“, sagt Herault. Er fügt hinzu: „Da sie für jedes generative Modell spezifisch sind, kann unser Tool auch das verwendete KI-Modell identifizieren.“  

Kompliziert wird es, wenn die KI nur einen Teil der Arbeit übernimmt. 

Wenn eine Software eine Melodie erzeugt, diese aber anschließend von einem Musiker aufgeschrieben und von einem Orchester eingespielt wird, findet sich in der Masteraufnahme keine Spur der Software. Dasselbe gilt, wenn ChatGPT Liedtexte schreibt, die dann von einem Menschen im Studio gesungen werden. 

„Wenn es sich tatsächlich um einen Hybrid-Track handelt, bei dem einige Elemente von KI und andere von Menschen erstellt wurden und die finale Version von einem Menschen zusammengestellt wird, wird es sofort schwieriger, eindeutige Schlussfolgerungen zu ziehen“, räumt Herault ein. Hybrid-Tracks für Deezer seien derzeit „ein Forschungsgebiet“, doch endgültige Erkenntnisse stünden noch aus. 

Dies ist die größte Einschränkung der Steuerungsmöglichkeiten des Ariston. Künstliche Intelligenz in einem fertigen Song zu finden, ist das eine, zu beweisen, dass sie zu dessen Erstellung verwendet wurde, etwas ganz anderes. 

Anstatt das Lied erst am Ende zu analysieren, kann man das Programm anweisen, gleich zu Beginn eine unsichtbare Signatur hinzuzufügen. Dies nennt man Wasserzeichen. 

Google DeepMind hat beispielsweise SynthID entwickelt, das ein unmerkliches digitales Signal direkt in die Audiodatei einbettet. Es handelt sich dabei nicht um eine Textzeile in den Dateidaten (die sich leicht löschen lässt), sondern um ein im Klang eingebettetes Signal, das Schnitten und Manipulationen widersteht. Während Deezer mithilfe von Berechnungen nach versehentlich hinterlassenen Spuren sucht, wird das Wasserzeichen bewusst platziert, um die Wiedererkennung zu gewährleisten. Die beiden Technologien ergänzen sich somit. 

Das Wasserzeichen funktioniert jedoch nur, wenn der Entwickler des Programms es einsetzt. Wenn jemand Open-Source-Software verwendet, die so modifiziert wurde, dass sie keine Spuren hinterlässt, versagt das System. 

Deshalb konzentriert sich die Branche heute auf die Provenienz: die Rekonstruktion der digitalen Geschichte einer Datei. Dabei kommen Standards wie C2PA zum Einsatz – ein unveränderlicher Datensatz, der die Entstehungsgeschichte und die erfolgten Änderungen dokumentiert. Eine digitale „Identitätskarte“, die den Song begleitet. 

Um die Sanremo-Regel durchzusetzen, ist ein mehrstufiges System erforderlich. Anstatt einen Algorithmus zu fragen: „Ist es KI oder nicht?“, sollten Prüfungen mehrere Datenpunkte abgleichen: Aussagen der Autoren, Wasserzeichenrecherchen, forensische Analysen und, in Verdachtsfällen, die Untersuchung des Originalproduktionsmaterials (Demos, Stems, Zwischenversionen). 

Die rechtliche Frage bleibt bestehen: Ein Algorithmus, der eine hohe Wahrscheinlichkeit für synthetische Spuren signalisiert, ist zwar ein gutes Warnsignal, aber die Annahme, dass dies ein ausreichender Beweis ist, um einen Konkurrenten auszuschließen, ist eine ganz andere Sache. 

Das Problem ist zahlenmäßig dringlich. „Wir haben bereits den Punkt erreicht, an dem KI-generierte Titel an Spitzentagen mehr als 50 % der täglichen Deezer-Lieferungen ausmachen“, sagt Herault. „Das betrifft uns, aber auch andere Apps, da diese Lieferungen auch auf andere Plattformen verteilt werden.“ 

Doch dieser Berg an Uploads spiegelt sich nicht im Erfolg der Hörer wider. Rein synthetische Musik macht nur 1 bis 3 % aller Streams aus, und etwa 85 % dieser Streams sind gefälscht (durch Bots generiert). Laut Deezer stammen lediglich 0,5 % der Streams von Menschen, die synthetische Musik hören. Um diesem Phänomen entgegenzuwirken, kennzeichnet die Plattform diese Titel und schließt sie aus algorithmischen und redaktionellen Playlists aus. 

Herault prognostiziert, dass KI die Musiker nicht verdrängen wird. „Es ist sehr wahrscheinlich, dass wir immer mehr Künstler sehen werden, die KI in ihren kreativen Prozess einbeziehen“, aber er glaubt nicht, dass Musik, die vollständig von Maschinen erzeugt wird, einen bedeutenden Marktanteil erobern wird. 

„Die Leute werden weiterhin mit den Künstlern ihrer Lieblingsmusik in Kontakt bleiben wollen, auch indem sie sie live erleben“, bemerkt der Manager. Ein Konzert – man denke nur an die Oasis-Tour, die derzeit Hunderttausende dazu bringt, ihre E-Mails zu aktualisieren, in der Hoffnung, einen Kaufcode zu erhalten – erfordert echte Künstler, die wissen, wie man auf der Bühne spielt, sonst wäre es den Ticketpreis nicht wert. 

Das Dilemma bleibt bestehen und beschäftigt Stefano De Martino, den künstlerischen Leiter des Festivals des italienischen Liedes, sowie die Freunde von Domenica, die den Strega-Preis verleihen, und die Hollywood Academy: Wie viel Maschine darf in einem kreativen Werk stecken, damit es noch als menschlich gilt? 

-

Shows

webinfo@adnkronos.com (Web-Info)

In der App fortfahren Die Nachrichten aus Ihrer Stadt, in Echtzeit.
In der App öffnen