Man macht sich heute über die schlechte Qualität von KI-Synchros lustig, die noch vor 2-3 Jahren völlig undenkbar gewesen wäre. Es ist nicht erschreckend schlecht, sondern mit Blick auf die Kürze der Entwicklungszeit für KI-Synchros erschreckend gut. KI lernt mit exponentiellem Wachstum. Die Verbesserung von heute zu "perfekt" wird nicht noch einmal so lange dauern wie von "Null" zu den heutigen Ergebnissen.
Es ist völlig verfehlt, sich darüber lustig zu machen oder die Gefahr klein zu reden. KI wird etablierte Stammsprecher wahrscheinlich nicht verdrängen. Aber bei Nachwuchsschauspielern und aufstrebenden Stars, die noch keine Feststimme haben, wird man diesen wahrscheinlich nach und nach KI-Stimmen verpassen bzw. deren Originalstimmen ins Deutsche übertragen, vielleicht sogar lippensynchron, indem man auch die Mundbewegungen digital anpasst.
Also sorry bei aller Liebe aber diese KI-Synchro klingt absolut grauenvoll. Schrecklich monoton, ohne Schauspiel, nicht lippensynchron, völlig falsch betont, seltsame Dialoge, die wahrscheinlich auch mit KI erstellt wurden.
Was ich mich nur frage ist, ob da reale Menschen als Modelle gedient haben oder ob die Stimmen gänzlich mit KI erstellt wurden.
Zitat von Taccomania im Beitrag #1042Man macht sich heute über die schlechte Qualität von KI-Synchros lustig, die noch vor 2-3 Jahren völlig undenkbar gewesen wäre. Es ist nicht erschreckend schlecht, sondern mit Blick auf die Kürze der Entwicklungszeit für KI-Synchros erschreckend gut. KI lernt mit exponentiellem Wachstum. Die Verbesserung von heute zu "perfekt" wird nicht noch einmal so lange dauern wie von "Null" zu den heutigen Ergebnissen.
Es ist völlig verfehlt, sich darüber lustig zu machen oder die Gefahr klein zu reden. KI wird etablierte Stammsprecher wahrscheinlich nicht verdrängen. Aber bei Nachwuchsschauspielern und aufstrebenden Stars, die noch keine Feststimme haben, wird man diesen wahrscheinlich nach und nach KI-Stimmen verpassen bzw. deren Originalstimmen ins Deutsche übertragen, vielleicht sogar lippensynchron, indem man auch die Mundbewegungen digital anpasst.
Aber irgendwie habe ich das genauso (glaube sogar von dir) schon vor ein oder zwei Jahren gelesen
Zitat von Taccomania im Beitrag #1042Man macht sich heute über die schlechte Qualität von KI-Synchros lustig, die noch vor 2-3 Jahren völlig undenkbar gewesen wäre.
Die schlechte Qualität von KI-Synchros war damals schon so wie die, die ich gerade von "Deadly Patient" über mich ergehen ließ (den Ausschnitt des Weihnachtsfilms habe ich noch nicht "genossen")! Aber du hast deinen Beitrag wohl anders gemeint...! Die Betonungen sind oft monoton und unpassend und die Dialoge wirken, wie vor 20 Jahren mit dem Google-Übersetzer geschrieben (der allerdings mA§n. in der Zwischenzeit deutlich weiter entwickelt wurde)
Ich mache mich auch nicht über KI-Synchros lustig ich war vorhin schon nach ein paar Minuten eher entsetzt über diese "Synchro". sO habe ich auch die Reaktionen anderer Forumianer verstanden.
Danke. Kann mir nicht vorstellen, dass sich das jemand wirklich so anguckt bzw. -hört. Das muss dem Anbieter eigentlich auch klar sein. Hätte man sich daher echt sparen können.
Zitat von Insomnio im Beitrag #1037Ach.Du.Meine.Güte
Wenn das alles ist was KI kann, muss da aber niemand um seinen Job bangen.
Zitat von Dennie03 im Beitrag #1043Also sorry bei aller Liebe aber diese KI-Synchro klingt absolut grauenvoll. Schrecklich monoton, ohne Schauspiel, nicht lippensynchron, völlig falsch betont, seltsame Dialoge, die wahrscheinlich auch mit KI erstellt wurden.
Was ich mich nur frage ist, ob da reale Menschen als Modelle gedient haben oder ob die Stimmen gänzlich mit KI erstellt wurden.
Die größten Fortschritte hat die KI bislang bei der Generierung von Bildern und Animationen gemacht und das vor allem deshalb weil die von enorm vielen Daten lernen oder besser gesagt abschöpfen konnte.
Mit der Nachbildung menschlicher Emotionen und Schauspiel tut die sich noch immer schwer.
Zitat von marakundnougat im Beitrag #1044 Aber irgendwie habe ich das genauso (glaube sogar von dir) schon vor ein oder zwei Jahren gelesen
Nein, habe ich erst kürzlich geschrieben. Man muss immer berücksichtigen, wann und wie das angefangen hat und wo wir jetzt schon stehen. Dass das derzeit als Alternative zu menschlichen Sprechern noch indiskutabel ist, steht außer Frage. Wer allerdings weiterhin glaubt, KIs seien dazu niemals in der Lage, hat vermutlich vor 3-4 Jahren auch nicht geglaubt, dass heute jeder Depp mit kostenlosen KIs realistische Fotos und Videos mit einfachen Prompts erstellen kann, inklusive realistischer Sprachausgabe.
Die Synchronbranche läuft nicht umsonst Sturm gegen KI-Einsatz. Wenn man qualitativ nichts zu befürchten hätte, könnte man ja gelassen in die Zukunft blicken. Es geht doch nur vordergründig darum, dass Netflix & Co. die Stimmen aktueller Sprecher als Trainingsdaten gebrauchen möchte. Denn natürlich können KIs auch mit urheberrechtsfreien Tonaufnahmen trainiert werden und sich mit rasanter Geschwindigkeit verbessern. Die Aktionen der Synchronbranche würden doch nicht aufhören, wenn die KI-Firmen zusichern würden, dass man die Stimmen der aktuellen Sprecher nicht zu Trainingszwecken heranzieht, sondern die KIs eben mit anderen Stimmproben trainiert. Es gibt genug urheber- und persönlichkeitsrechtsfreie Tonaufnahmen und gewiss auch genug junge Schauspieler und Schauspieschüler (oder auch "Hinz und Kunz"), die gegen geringes Entgelt bereit sind, KIs mit ihren Stimmen zu trainieren. Dafür benötigt man nicht die Stimmen aktueller Synchronstars.
Hinzu kommen bei aktuellen und zukünftigen KIs immer besser werdende "Humanize"-Funktionen, d.h., das typisch KI-artige bei der Ausgabe von Ergebnissen (Texte, Bilder, Videos, Ton) wird in einem zweiten Schritt sodann "vermenschlicht". Zudem können KIs dutzende Varianten eines Satzes anbieten und werden in kurzer Zeit genau wissen, was der Regisseur sich vorstellt, so wie heute schon ChatGPT & Co. - vor drei, vier Jahren noch komplett undenkbar - sich sehr "menschlich" verhalten und nach und nach ihr "Gegenüber" kennenlernen und aus früheren Chats wissen, worauf der Nutzer hinaus will.
Arroganz und Naivität sind aus meiner Sicht fehl am Platz.
Probier doch einfach mal eine KI wie "ElevenLabs" oder "AnySpeech" aus. Du kannst dort jeden beliebigen Satz ein- und der KI vorgeben, wie sie klingen soll. Selbst wenn die KI aus urheber- und persönlichkeitsrechtlichen Gründen die Nachahmung eines konkreten Sprechers verweigert (z.B. Arnold Marquis), kannst man trotzdem angeben, sie solle eben so ähnlich klingen wie frühere markante Synchronsprecher, nämlich wie eine Mischung aus früheren "Cowboy-Sprechern",also "männlich", "rauhbeinig", "wüstenerprobt", etc. Das ist völlig legal und vom Ergebnis beeindruckend, zumal es sich um kostenlose Software für jedermann handelt. Vor allem die Fortschritte sind bemerkenswert. Wenn man vor 2-3 Jahren gesagt hat, die KI solle wie "Terrence Hill" klingen, war das kaum erkennbar, ist aber heute schon deutlich besser (siehe den aktuellen Terrence-Hill-Kurzfilm mit Danneberg-Imitat), wenn auch noch nicht perfekt. Das wird es aber vielleicht nächstes oder übernächstes Jahr sein.
Das Ergebnis hier ist überraschend schlecht, weil es mittlerweile genügend Beispiele gibt die zeigen, dass es deutlich besser sein könnte. (Selbstredend für uns immer noch indiskutabel.) KI ist ja auch nicht KI. Je nachdem wie man arbeitet, womit man arbeitet, etc. wird es qualitative Sprünge geben. Das hier wirkt wie Marke Bodensatz, schnell zusammengeschustert. Man könnte es besser machen mit den Tools, die es heute gibt und die natürlich auch nur besser werden.