KI-Update Deep-Dive: Die Zukunft menschlicher Synchronstimmen ist bedroht

Shownotes

Wir haben im deutschsprachigen einen wunderbaren Luxus: Synchronsprecherinnen und Sprecher. Wir verbinden ganz bestimmte Stimmen mit ganz bestimmten Hollywood-Ikonen. Wenn solch eine Stimme ausgetauscht werden muss, stört uns das. Genauso sind wir irritiert, wenn wir eine Synchronsprecherin als Schauspielerin in einer Rolle sehen. Die vertraute Stimme passt für uns dann nicht zu ihrem echten Gesicht. Eine so perfekte Synchronisation, die uns vergessen lässt, dass es eine Übersetzung ist, das ist eine echte Kunst.

Und genau diese Künstlerinnen und Künstler kämpfen gerade um ihre Existenz. Streamingdienste wollen mit bestimmten Vertragsklauseln erreichen, dass sie bereits aufgenommene Stimmen zum Training von KI-Systemen nutzen dürfen. Die Techjournalistinnen Svea Eckert und Eva Wolfangel haben sich kürzlich in einer Folge Ihres c’t Podcasts They Talk Tech mit dem Thema beschäftigt und übernehmen daher heute das Ruder im KI-Update. Zu Gast ist Anna-Sophia Lumpe, die Vorsitzende des Verbands Deutscher Sprecher:innen. Sie erklärt, warum es ihr und ihren Kollegen längst nicht mehr ums simple Kopieren einer Stimme geht.

=== Anzeige / Sponsorenhinweis === Dieser Podcast wird von einem Sponsor unterstützt. Alle Infos zu unseren Werbepartnern findet ihr hier. https://wonderl.ink/%40heise-podcasts === Anzeige / Sponsorenhinweis Ende ===

Heise+ Abonnent werden: https://www.heiseplus.de/audio

Artikel zur Podcastfolge: https://heise.de/-11420198 They Talk Tech: https://frauen-technik.podigee.io/ https://kuenstlerische-intelligenz.podigee.io/ https://www.heise.de/thema/KI-Update https://pro.heise.de/ki/ https://www.heise.de/newsletter/anmeldung.html?id=ki-update https://www.heise.de/thema/Kuenstliche-Intelligenz https://the-decoder.de/ https://www.ct.de/ki

Transkript anzeigen

00:00:02: Das KI-Update, ein heise Podcast mit redaktioneller Unterstützung von The Decoder.

00:00:14: Ich bin Isabel Grünewald und dies ist unser Diebdive zum Wochenende!

00:00:20: Wir haben bei uns im deutschsprachigen Raum einen

00:00:23: wunderbaren

00:00:24: Luxus.

00:00:25: Professionelle Synchronsprecherinnen und Sprecher

00:00:28: die fremdsprachige

00:00:29: Filme oder Serien nicht nur lippen synchron sondern auch emotional authentisch übersetzen.

00:00:36: Wie gut es uns geht merke ich immer wieder, wenn ich im Ausland mal den Fernseher anschalte und dort Untertitel gezeigt werden.

00:00:43: Oder wie ich es einmal in einem Land erlebt habe?

00:00:45: Einfach ein Übersetzer!

00:00:47: Einen Dialog

00:00:48: gnadenlos gelangweilt über die Originaltonspur spricht.

00:00:52: Wir hingegen kennen von jeder Hollywood-Ikona eine ganz bestimmte deutsche Stimme Und wenn solch eine

00:00:59: Stimme

00:00:59: ausgetauscht werden muss dann reagiert das Publikum fast immer erst mit Ablehnung an der genümeren Marge von den Simpsons.

00:01:06: Genauso sind wir irritiert, wenn wir eine Synchronspeicherin selbst als Schauspielerin in einer Rolle sehen.

00:01:13: Die

00:01:13: vertraute

00:01:14: Stimme passt dann gar nicht zu ihrem echten Gesicht weil wir damit eine ganz andere Person verbinden!

00:01:19: Eine so perfekte Synchronisation die uns vergessen lässt dass es eine Übersetzung ist Das is echte Kunst Und genau diese Künstlerinnen und Künstlern kämpfen gerade um ihre Existenz.

00:01:31: Hallo Du kennst diese Gesichter mit diesen Stimmen Aber du kennst nicht die Gesichter hinter den Stimmen.

00:01:40: Ich bin Synchronschauspielerin und die deutsche Stimme von Angelina Jolie, ich bin Synchron-Schauspieler und die deutschen Stimme vom Jason Momoa.

00:01:47: Du kennst Melissa McCarthy?

00:01:50: Du kennest sie mit meiner Stimme!

00:01:51: Ich bin sozusagen ein Teil von Melissa.

00:01:54: Und jetzt sollen wir amputiert werden... Ich bin

00:01:58: SpongeBob

00:01:59: mit all seinen

00:02:01: Emotionen

00:02:03: Echt?

00:02:05: Keine künstlichen.

00:02:06: Wir alle sollen bald

00:02:07: eine Computerstimme bekommen.

00:02:09: Und dann müsst ihr euch Filme ansehen mit künstlichen Stimmen von Robotern und diese Roboter wurden mit unseren Stimmen trainiert ohne unsere Zustimmung auf illegale Weise.

00:02:23: Der Protest richtet sich vor allem gegen Streamingdienste, die wollen mit bestimmten Vertragsklausen

00:02:29: erreichen

00:02:29: dass sie bereits aufgenommene Stimmen zum Training vom KI System nutzen dürfen.

00:02:34: Zvea Eckert und Eva Wolf-Angel haben sich kürzlich in einer Folge ihres CT-Podcasts, They Talk Tech mit dem Thema beschäftigt.

00:02:42: Zu Gast war Anna Sophia Lumpe.

00:02:44: Sie hat Phonetik studiert als ausgebildete Schauspielerin und Sprecherin und Vorsitzende des Verbands Deuter Sprecherellen.

00:02:52: Sie erklärt da, warum es ihr und ihren Kollegen längst nicht mehr nur um simple Kopien einer

00:02:57: Stimme

00:02:57: geht?

00:02:58: Und

00:02:59: weil

00:02:59: ich dieses Thema so super

00:03:00: spannend finde,

00:03:01: übergebe ich jetzt an meine Kolleginnen von They Talk

00:03:04: Tech.

00:03:05: Hi und herzlich willkommen!

00:03:06: Ich bin Svea Eckhardt,

00:03:07: Tech-Journalistin

00:03:08: Und ich bin Eva Wolfangen ebenfalls Tech- Journalistin.

00:03:15: Es ist immer total der Kasseffekt zum KronensprecherInnen in echt zu sehen.

00:03:20: dann sprechen die mit der Stimme z.B.

00:03:22: von Bruce Willers oder so, also von irgendeinem superbekannten Schauspieler und dann merkt man halt so hey okay das ist ja natürlich nicht die Stimme vom Schauspieler sondern gehört einem Mensch, einem echten Mensch.

00:03:32: Und da habt ihr ganz stark aufmerksam gemacht auf ein Problem was absolut viral virulent ist auch dass euch eure Stimmen geklaut werden.

00:03:41: Ja das läuft jetzt schon eine ganze Weile.

00:03:45: dieses Problem Also mittlerweile sind wir an den Punkt angekommen unbedingt mehr darum geht, dass tatsächlich unsere individuellen Stimmen kopiert werden.

00:03:55: Dass aber sie dazu dienen, Systeme zu trainieren die dann mit uns in Konkurrenz gehen sollen.

00:04:03: und das haben wir nämlich gefragt ja wahrscheinlich das gleiche Problem, dass man die Kopie gar nicht nachweisen kann.

00:04:08: also wenn natürlich vielleicht ist es erste Die erste Hoffnung von solchen Unternehmen, dass Sie eure Stimmen direkt nachmachen können so dass man euch nicht mehr braucht und die deutschen Hörerinnen dann gar nicht mehr sich umstellen müssen.

00:04:19: Aber der nächste Schritt ist ja, dass man eure Stimme nutzt um sie ... Ja.

00:04:23: Umzubauen sodass man es gar nicht mehr nachweisen kann?

00:04:26: Ja!

00:04:26: Also diese Unternehmen wissen auch das Sie jetzt rein persönlich also vom Persönlichkeitsrecht wirklich Probleme bekommen wenn sie jetzt zum Beispiel meine Stimme wirklich kopieren.

00:04:34: Also das ist denen schon bewusst.

00:04:36: aber viel wichtiger ist ja nicht meine Stimmfarbe sondern meine Stimmpführung und die kann ich ja mit Hilfe dieser Systeme halt von von der Stimme Farbe trennen.

00:04:47: Und die Stimmführung ist das, was halt eben dann zum Beispiel jemanden, der kein Deutsch sprecht, synthetisch Deutsch sprechen lassen kann und das ist viel

00:04:55: wichtiger.

00:04:56: Die Stimmführung!

00:04:56: Das musst du erklären, was es

00:04:57: bedeutet?

00:04:58: Ja wo setze ich eine Pause?

00:05:00: Wo... wie drücke ich Liebe aus?

00:05:03: Wie klingt das wenn ich mit einem Mann rede?

00:05:05: Wie klinkt das wenn nicht mit einer Frau

00:05:06: rede?!

00:05:07: Wie lache

00:05:07: ich!?

00:05:08: Wie intoniere ich Emotionen?

00:05:11: All dass..das is ja das was uns auch zu Sprecherinnen macht.

00:05:15: Also natürlich, wenn du eine schöne Stimme hast.

00:05:18: Das hilft auf jeden Fall.

00:05:19: aber wenn du damit nicht umgehen kannst bist du keine Sprecherin und das ist dieses Handwerk.

00:05:25: also ein Freund von mir sagt immer Du hast die Handpuppe Und die handpuppen an sich macht ja erstmal gar nichts.

00:05:31: Die Hand in der Puppe.

00:05:33: das ist dass worum es geht.

00:05:36: Die Art wie du als Sprecherin sprichst transportiert Emotionen Feinheiten auch von so einem Gespräch.

00:05:44: Und das sind Dinge, die KAI-Systeme noch nicht so können und das versuchen sie sich gerade ... Dafür brauchen Sie eure Stimme!

00:05:51: Da hilft auch nur tatsächlich fürs Deutsche.

00:05:53: Hilft auch nur die Stimme der deutschen Sprecherinnen und Sprechern.

00:05:56: Die sind quasi abhängig von euch.

00:05:59: Nur dass es

00:06:00: euch nicht so spüren, dass ihr abhängigs sind sondern sie benehmen sich

00:06:03: Wie eine offene Hose.

00:06:07: Ja

00:06:07: natürlich, es geht halt wirklich um unser Handwerk nicht nur an unser Handwerks sondern eben auch unsere hochpersönlichen tiefen Emotionen.

00:06:15: also weil im Gegensatz zu anderen Kunstschaffenden sind wir ja direkt verbunden mit unserem Werk.

00:06:22: das mag vielleicht irgendwie das ist privilegiert bestimmt aber wir haben eben einen Beruf den wir dadurch verbessern dass wir am leben sind und empfinden, lieben, hassen, traurig sind.

00:06:38: Und leiden und all das im Idealfall in unsere Arbeit einfließen lassen.

00:06:44: Deswegen ist dieser Ausdruck, dass es das Gold, was wir produzieren.

00:06:49: Ich stelle mir das wahnsinnig schwer vor ... einfach festzustellen, auch gerade wenn es eben nicht so ist dass die Stimme eins zu eins kopiert wird.

00:06:59: Also ich erinnere mich an ein dieser ganz ganz frühen Fälle.

00:07:03: das war Bev Standing, das ist eine kanadische Synchron- und Werbesprecherin.

00:07:08: Das ist schon in den Jahren des Jahrhunderts zwanzig gewesen.

00:07:11: Die hat vor Jahren mal einen Auftrag angenommen, hat dort Aufnahmen gemacht Und dann ist rausgekommen, dass TikTok also, sprich ByteDance ihre Stimme benutzt hat für Texte die für die Text-SoSweetschfunktion von TikTok.

00:07:26: Und das ganze Zeit aufgefallen, weil sie angesprochen wurde von Freundinnen und Freunden nach dem Motto Momentchen mal.

00:07:32: Das ist doch deine Stimme!

00:07:34: Solche Fälle gab es immer wieder auf den Eier hatte diesen Fall mit Scarlett Johansson wo die Stimme sehr ähnlich war und dann auch die Schauspielerin intervenieren konnte so.

00:07:47: eben wie du gesagt hast, also wo es um so ganz typische, ganz prägnante Stimmen geht die sehr ähnlich sind.

00:07:53: Wo du dann auch was in der Hand hast.

00:07:54: aber wenn's um sowas geht wie Es werden zum Beispiel ganze Filme, ganze Serien In KI-Systeme eingefüttert Wie willst du jemals das merken?

00:08:06: Ja

00:08:06: und vor allem beweisen oder

00:08:08: beweisen ob dein Stimme dann benutzt wurde

00:08:11: Absolut.

00:08:12: Und dann ist halt eben auch diese Haltung dahinter, dass wenn das Opfer es nicht beweisen kann, dann ist es eben nicht passiert.

00:08:20: und das ist bei so einer Machtverschiebung unheimlich gefährlich.

00:08:25: Weil wir haben ja auch die Situation, dass unsere Werbespots zum Beispiel wie als Sprecherin machen.

00:08:30: Also ich spreche jetzt von Werbung weil ich das meistens mache.

00:08:33: Das ist eigentlich total normal, dass solche Spots ja auch auf YouTube laufen oder da auch gehostet werden von den Firmen und davon gehen wir auch aus.

00:08:42: Oder dass wir auch unseren eigenen Demos auf YouTube posten.

00:08:45: Und jetzt habe ich neulich gelesen, dass beim Münchner Filmfest ein Vortrag war und da war auch jemand von Google aus dem Publikum gefragt, wie diejenigen, die Filme zum Beispiel oder Trailer auf YouTube hochladen, garantieren können dass damit nicht KI trainiert wird.

00:09:01: Und die Antwort von Google war ja gar nicht!

00:09:03: Weil YouTube nutzen wir halt generell zum Training.

00:09:07: Das bedeutet dabei das jemand der dann einen Trailer hochlädt oder ein Werbespot im Grunde schon das Recht verletzt ohne dass die Person das möchte weil sie hat sich bei mir das Recht nicht eingekauft dass mit meiner Stimme trainiert werden darf.

00:09:20: Aber sie tut's einfach auf YouTube, weil ganz normal ist es für das machen.

00:09:23: Genauso wie auch viele Hörbuchbücher zum Beispiel auf Spotify landen, wo das genauso gemacht wird.

00:09:28: und wir kommen jetzt in ein rechte Debakel was für uns ganz schlimmer ist, weil das unsere Lebensgrundlage halt zerstört.

00:09:36: Weil natürlich in dem Moment, wo die KI trainiert ist dann menschliche Stimmen nicht mehr gebraucht werden, ne?

00:09:41: Das is so im Prinzip.

00:09:43: die Konklusio Ja,

00:09:45: an vielen Stellen.

00:09:46: Genau also.

00:09:46: natürlich ist es so das generiertes Audio nicht die Tiefe und Qualität erreicht wie eine echte Interpretation erreicht.

00:09:55: aber wir wissen auch dass diejenigen die das entscheiden sich meistens darüber keine Gedanken machen und dass die Prämisse nicht ist ein möglichst gutes Produkt zu erstellen sondern da sind wir so ein bisschen parallel mit unserem Thema Eva, dass man halt einfach was generiert weil man LinkedIn-Post machen will.

00:10:15: Man will halt mehrfach am Tag irgendwas posten und das ist ja egal ich muss es hier einfach nur raushauen Ich will ja einfach nur ein Bild haben.

00:10:22: Ich habe einen Anspruch darauf!

00:10:24: Ich nehme das, weil es da ist.

00:10:26: Ist ja auch oft die Idee also dahinter Barrierefreiheit?

00:10:29: Also ich kann Artikel vorlesen lassen, ich kann Podcasts in drei Sprachen übersetzen lassen, Aufnehmen, also mit Mundbewegungen noch dazu.

00:10:43: Also die Idee ist natürlich ich kann viel mehr Reichweite für meinen Content erzeugen.

00:10:48: Die Möglichkeit sind schon groß!

00:10:50: Ich kann schon nachvollziehen warum man das will?

00:10:53: Ja genau und das was du selber eigentlich kreierst soll dann aber Urheberrecht unterliegen Aber nicht das was Du nutzt um deine Urheberrechtsgeschützten Inhalte an andere weiter zu leiten.

00:11:05: Und ich möchte bitte auch noch mal auf die Barrierefreiheit eingehen, ne?

00:11:08: Das ist blanker Honig dieses Argument!

00:11:10: Weil die Menschen, die auf Barrierenfreiheit angewiesen sind nicht Zuhörer in zweiter Klasse sind.

00:11:15: Die haben genauso Anspruch... ordentliche Inhalte zu konsumieren.

00:11:18: Und ich habe dazu auch mit einer sehengeschränkten Person gesprochen, die halt Hörfassung von Filmen anfertigt.

00:11:25: Die ist da total vielleicht beleidigt würde man sagen und auch aufgebracht dass das gemacht wird.

00:11:33: Das ist wieder dieses...das ist so ein Nebenargument was benutzt wird um eine Praxis die hochgradig verwerflich ist zu legitimieren.

00:11:44: Das heißt Argument ist, das können wir dann schon mal so machen.

00:11:47: KI-generiert ist zwar nicht ganz so gut und da fehlen dann wahrscheinlich noch ein paar Dinge aber es reicht ja unhauptsache mit Konflikten.

00:11:53: Ja, bzw immerhin wird überhaupt gemacht also der Artikel den früher niemand vertont hätte oder wo die Verlage sahen.

00:12:00: Artikelverton sorry also wir können jetzt hier keine Sprecher beschäftigen die jeden Zeitungsartikel vertonen Aber in der KI Stimme des Vorlesens ist halt schnell gemacht.

00:12:11: Aber du kannst ja auch genau so sagen, also wenn wir synthetische Stimmen benutzen – synthetisches Audio.

00:12:17: Das bedeutet ja nicht dass das rechtefrei sein muss.

00:12:21: Also es ist ja durchaus möglich.

00:12:23: Genau!

00:12:24: Du könntest das ja mit einer Lizenz machen.

00:12:26: Du könntes ja eine Person dafür vergüten, dass es eben eine synthetischen Stimme gibt und die ist dafür vergütet und die macht natürlich einen größeren Vertrag und es wird nicht billig sein.

00:12:37: Es wird nicht umsonst sein sagen wir so.

00:12:40: Aber die Alternative ist halt, dass wir Urheberrecht, Persönlichkeitsrecht, Datenschutz all solche Sachen einfach aushebeln und sagen naja jetzt weg heil ich den Mittel!

00:12:51: Dein Kollege von dir hat in dieser Netflix-Debatte gesagt, da hab ich in einem Tagesshowartikel gelesen.

00:12:58: Ja?

00:12:59: Zwar Patrick Wienzefski ist die Stimme von Hollywoodstars wie Hugh Grant und Tom Cruise.

00:13:04: Er hat gesagt meine Stimme verschwindet im Bauch der KI und ich stehe mit leeren Händen dar.

00:13:08: Und du hast ja auch gerade gesagt es geht eigentlich darum euch zu ersetzen, dass ihr seid dann weg vom Fenster.

00:13:16: Ist denn diese KI-Klausel bei Netflix ... Wie ging das weiter?

00:13:20: Raus inzwischen und wie ist anderswo mit entsprechenden Verträgen?

00:13:24: Nein, bisher ist in den Netflix-Verträgen die KI Trainingsklausel weiterhin enthalten.

00:13:30: Es gab auch bisher stand jetzt keine Gespräche mit Netflix das zu ändern.

00:13:36: Es gibt sehr viele bekannte Stimmen, die weiterhin nicht für Netflix arbeiten.

00:13:40: deswegen sehen wir ja jetzt auch dass Serien ohne bekannte Stimmen oder nicht mit den gewunden Stimmen rauskommen.

00:13:46: Gibt auch viel Kolleginnen die sich da sehr öffentlich zu positioniert haben und für sich einfach entschieden haben, ich arbeite nicht mehr für Netflix.

00:13:55: Und das hat aber nicht geholfen sozusagen?

00:13:57: Das heißt der Ausschrei der deutschen Zuschauerinnen ist nicht groß genug oder... Vielleicht

00:14:01: ist ja der Schmerz noch nicht groß genug.

00:14:04: Aber das Problem beim Synchronen ist auch immer dass du natürlich immer vorproduzierst.

00:14:08: Also wenn ich heute sage Ich spreche die Rolle nicht mehr Dann wird erst in Monaten den Zuschauenden überhaupt klar werden was ich da gerade entschieden habe.

00:14:18: Das heißt es ist natürlich immer in Bewegung Aber das ist nicht vom Tisch.

00:14:33: Und es hat die vermute ja auch in anderen Zusammenhängen, dass ihr solche Verträge, dass sie da gerade Kämpfe führt.

00:14:39: oder ist das...

00:14:40: Interessanter Reisen ist

00:14:41: Netflix?

00:14:42: Ja also Netflix sind die ersten, die KI-Training explizit erwähnt haben Und dann eben auch gleich eingeschlossen haben.

00:14:51: Insofern, es ist natürlich lobenswert das sie's erwähnt haben weil es eine Nutzung ist die Art und Weise wie es jetzt erlaubt sein soll für mich nicht tragbar.

00:15:01: aber wir haben sonst keine Verträge die das explizit erlauben oder wirklich ansprechen.

00:15:06: Aber was wir auf jeden Fall merken ist dass Wir hatten vom Verband, haben wir schon lange eine KI-Ausschlussklausel zur Verfügung gestellt.

00:15:16: Die man in Verträge einfügen kann und die Erfahrung bei den Sprecherinnen zeigt das Unternehmen, die nicht in den USA ansässig sind größtenteils kein Problem damit haben diese Klausel einzufügen in die Verträge.

00:15:29: also ob das jetzt Hörbücher sind oder Games oder eben ja ganz normale Bewerbung ist es sowieso normal einfach sehr detaillierte Lizenzen nur einzukaufen.

00:15:40: Aber bei US-Unternehmen sind sie nicht dazu bereit, diese Ausschlussklausel einzubauen und unsere Haltung war da immer sehr klar.

00:15:49: das bedeutet dass Sie unserer Auffassung nachtrainieren.

00:15:54: Das heißt also ich will noch mal so ein bisschen auch dahin kommen was eigentlich geschehen müsste.

00:15:59: ne?

00:15:59: Dass eine ist... wie so eine Art Gema geben muss für Stimme.

00:16:05: Also das heißt, dass sie irgendwie beteiligt werden müssen, also die Stimmen müssen beteilicht werden von wiederum von denen Unternehmen, die jetzt auch damit dann die Gewinne machen.

00:16:15: Das andere was ich mich frage auch in Feld, was ich gerne nochmal aufmachen würde, so auch in die Zukunft gedacht.

00:16:20: Es gilt jetzt ab dem zweiten August der EU AI-Akt und dort enthalten ist ja umfangreiche Kennzeichnungspflichten.

00:16:31: Das heißt also, Firmen, Sender etc.

00:16:34: müssen noch stärker als bisher kändlich machen wenn zum Beispiel auch eine Stimme künstlich erzeugt wurde und das... Das ist eine Entwicklung, da bin ich sehr gespannt darauf.

00:16:44: Im Moment sehen wir in diesen großen Publikumsstudien und Publikumforschung das Menschen tatsächlich eigentlich KI-generierte Stimmen ablehnen und sagen, nee also ich mag eigentlich... Ich möchte gerne von Menschen für Menschen auch so KI generierter ModeratorInnen, also gar nicht nur Stimmen mit Bild daziehen die Menschen im Moment noch die echten Menschen vor.

00:17:05: Und ich frag mich halt wo geht das hin?

00:17:09: Gehen wir auch eine Zukunft zu, wo Menschen sich einfach an Chatbots an KI-Stimmen, an KI Moderatorinnen gewöhnen.

00:17:16: Oder gehen wir in der Zukunft ... wo wir das einfach an den Klickzahlen sehen und wo die Menschen mit den Füßen abstimmen?

00:17:23: Also meine Vermutung ist, dass es rückläufig sein wird.

00:17:26: KI-Inhalte, synthetische Inhalte.

00:17:30: Und besonders dann wenn wir für irgendetwas bezahlen.

00:17:33: Also, weil ich persönlich sehe nicht ein, warum ich irgendwie ... Weil sie nicht zwanzig Euro für einen Monats-Abo bezahlen soll.

00:17:40: Und irgendjemand hat das mit einem Knopfdruck gemacht aus dann auch noch gestohlenen Daten?

00:17:45: Kannst du ja auch machen, mit einem Knopfdruck am Ende zu deinem Chatbot selbst fragen.

00:17:49: Ja und es ist halt auch eine Beleidigung so ein bisschen für die Zuschauenden würde ich sagen davon abgesehen das ist natürlich rein politisch.

00:17:56: auch ne wichtige wirtschaftliche Frage ist also aktuell.

00:18:00: wenn wir jetzt nur vom Synchron sprechen dass wird in Deutschland gemachtes ist eine große Branche.

00:18:04: das sind nicht nur wie Sprecherinnen da ist ja Übersetzung Buch Regie Die Aufnahme der Schnitt etc.

00:18:12: Da hängt sehr viel dran Und das ist eine funktionierende Branche und es ist eben eine Branche, die auch ihre Sozialabgaben zahlt und ihre Steuern zahlt.

00:18:21: Wenn wir uns vorstellen dass deren ganze Wirtschaftskette quasi wegfällt und nicht nur das sondern was die generiert haben abgezogen wird in ein anderes Land wo es dann benutzt wird um neue Gewinne zu generieren die wir bezahlen dann geht das nicht auf.

00:18:42: Und ich meine, dass ist natürlich dieser Kreislauf den Weg bei generativer KI generell haben.

00:18:47: Darüber habe Eva und ich gesprochen.

00:18:49: wenn das Internet nur noch voll ist mit Dreck woher soll denn das kommen was überhaupt trainieren kann, wenn man das jetzt als Nutzen braucht.

00:18:59: Also trainiert muss ja werden mit menschlichen Inhalten aber wer soll ihn

00:19:03: noch machen?

00:19:04: Was bleibt da noch übrig?

00:19:05: ne was wir hören und sehen und lesen wollen.

00:19:08: Genau bedeutet dass das wir eben ich habe das an anderer Stelle schon gesagt sitzen wir nur noch auf dem Sofa Daumen im Mund und werden befüttert.

00:19:18: Also

00:19:19: wie geht es euch denn?

00:19:20: Mich würde das wirklich mal interessieren.

00:19:22: Ich benutze ganz gelegentlich mal Nordbog LM, da kann man zum Beispiel ein paar Studien reingeben oder ich mache das manchmal wenn ich so größere Texte habe eine längere Autofahrt vor mir und hab jetzt weder Zeit noch Musse die also gründlich zu lesen und mit Textmarker und auszudrucken und so sondern ich fütter mir die in Nordbogen LM und dann kriege ich die irgendwie so podcastmäßig erzählt.

00:19:44: Da bleibt dann nicht so viel Hängen wie bei einem Text, aber ich denke immerhin hab ich sie überhaupt irgendwie halb auf dem Schirm und mal gehört.

00:19:51: Das sind künstliche Stimmen!

00:19:53: Wie geht's denn euch wenn ihr solche künstlichen Stimmen hört?

00:19:57: Also Anna rollen sich bei dir die Fuß- und die Fingernägel hoch oder sagst du nee es gibt ja auch Bereiche da finde ichs legitim.

00:20:03: also da kann ich mir anhören.

00:20:06: Ich find´s total anstrengend Aber das liegt natürlich auch daran.

00:20:10: Ich weiß, dass ich ganz anders höre aber ich beschäftige mich seit über fünfzehn Jahren mit meiner Stimme und eben besonders mit meine Stimmführung.

00:20:17: Und Stimmführung ist was...ich höre das!

00:20:20: Aber ich höre es auch wenn das von Menschen schlecht gemacht ist.

00:20:23: Also ich kann das nicht.

00:20:27: Es ist für mich so schwer erträglich.

00:20:29: Notebook LM habe ich am Anfang mir angehört Also nach fünf Minuten hatte ich so die Nase voll.

00:20:36: Weil das, weil es halt alle sind so begeistert und dann komm' ich erzähle jetzt von diesem tollen Inhalt!

00:20:40: Und ja genau, ja genau!

00:20:46: Es ist eine weitere Rolle in meinem Repertoire.

00:20:49: Ich möchte... also es macht mir überhaupt nichts aus wenn mir jemand was erzählt und die Person verspricht sich ist nicht gelernte Sprecherin, solange die Person an dem Inhalt angeknüpft ist.

00:21:03: Nicht jede Person muss Sprecherin sein!

00:21:05: Aber wenn du Audio-Inhalte produzierst dann musst du verstehen was du sagst und das steht ja hier überhaupt nicht zur Debatte.

00:21:16: da is kein Verständnis.

00:21:19: Ich find's voll interessant.

00:21:21: bei mir geht es tatsächlich auch so obwohl ich mich gar nicht so intensiv mit Stimme beschäftigt habe wie du.

00:21:26: Aber mich nervt genau diese Tonlage von Notebook

00:21:28: L.M.,

00:21:29: aber auch, es gibt auch so Leute, so RadiomoderatorInnen die einen totalen Singensang haben.

00:21:35: Da hab ich das Gefühl, sie haben eine Mustererkennung im Kopf trainiert durch irgendwie eine bestimmte Art wie offenbar Sprechtraining manchmal gemacht wird.

00:21:42: Die haben alle genau dieses Gleiche und da merkt man eben oft auch, dass die natürlich verstehen, was wir sagen, weil sie eigentlich nicht innerlich hinhören sozusagen, sondern diesen Singensangen darauf applizieren.

00:21:53: Und das ist was, was ich genauso schlecht ertragen kann.

00:21:55: Das hat mich wirklich interessiert gemacht für dieses Stimmen- und Sprecherinnen Thema.

00:21:59: Ich habe neulich eine Veranstaltung gehabt in Nürnberg am Theater, da hab' ich dir vorhin schon im ersten Teil erzählt, Anna.

00:22:06: Da haben wir auch – das habe ich dann nicht erzählt – am Rande so diskutiert, was sind denn die großen Versprechen?

00:22:11: Was könnte denn so KI für uns lösen?

00:22:14: dass ich viel Hoffnung gesetzt habe ist Übersetzungen, also Live-Übersetzung.

00:22:18: Dass ich mit Menschen auf der ganzen Welt live sprechen kann und die wirklich verstehen kann.

00:22:23: Und da kam mir dann so ein Gespräch darauf das es eigentlich nicht funktionieren kann weil diese Systeme eben nicht dieses ja die Nuancen transportieren, weil sie es eben nicht verstehen.

00:22:31: Die Feinheiten, die nicht verstehen ... Wann ich jetzt im Deutschen keine Ahnung ein lächelnde Stimme habe oder einen Zögern oder was so immer?

00:22:38: Oder eine Statie vielleicht auch sagt das ist jetzt ironisch gemeint, dass doch immer so, dass es nicht möglich ist, dass Kisys mir das aufnehmen und in diese andere Sprache

00:22:45: übertragen.

00:22:46: Aber ich frag mich irgendwie manchmal reicht ja auch Gudenath

00:22:49: Aber gerade für ein Zwischenmeldliches Gespräch doch

00:22:51: nicht.

00:22:51: Ja, aber du brauchst ja eben sagen wir mal an so einem Company-Kontext oder sowas wo du dann sagst und ich meine es ist nicht Vertragsverhandlungen über Merger oder sowwas Krasses sondern wenn du wirklich sagst okay wir haben irgendwie eine Teamskonferenz mit drei vier Nationen oder zwei Nationen.

00:23:08: Ich glaube als gibt es Anwendungsbereiche wo man sagen kann ok das ist gut genug Gut genug.

00:23:12: Aber die Träume, die uns versprochen werden sind andere.

00:23:15: Du wirst dich mit allen Menschen auf der Welt eine große Gemeinschaft erleben und du wirst Dich mitteilen können usw.

00:23:23: Und daran habe ich ne Zeit lang gehofft, weil mich das immer stresst auf Reisen.

00:23:28: Ich kann mich nicht wirklich mitteillen!

00:23:31: Das hatte ich jetzt an einer Eindruck bei dem was Du gesagt hast diese Stimmführung... an den richtigen Momenten.

00:23:38: Also du hast in einem anderen Podcast mal gesagt, man hört wenn du ein Lachen in der Stimme hast und man hat es in dem Podcast auch gehört.

00:23:46: Und ich frag mich halt wird das KI überhaupt jemals lösen können?

00:23:52: Da bin nicht wirklich skeptisch seither.

00:23:53: und weil du sagst irgendwie du denkst KI nur zum Glück nachlassen, ich könnte mir vorstellen dass es so einen Punkt ist wo Leute dann irgendwann merken hey wie ist wirklich was verloren gegangen?

00:24:01: wir fehlen die Zwischentune die Feinheiten von Stimme und Sprache die wir eigentlich haben als Menschen.

00:24:06: Ich glaube, dass wenn wir das so adaptieren und es wäre... Mein großes Problem ist der Satz good enough.

00:24:15: Es ist gut genug!

00:24:17: Ich finde, das Leben sollte nicht gut genug sein aber ich finde auch generell sollten wir nicht fragen unsere Haltung sollte nicht sein wie viel muss sich machen?

00:24:26: Dass es reicht sondern meine Haltung ist immer Wieviel kann ich machen Wozu bin ich im Stande?

00:24:34: Wo ist mein

00:24:35: Limit?".

00:24:35: Und nicht sich aufreiben oder so, sondern ich selber habe an mich den Anspruch die Zeit, die ich hier verbringe wirklich zu leben.

00:24:44: Vielleicht liegt das daran dass ich einen Beruf mache der dadurch ausgeprägt ist, dass ich lebe also meine Tätigkeit dadurch besser wird, dass Ich lebe.

00:24:54: aber für mich es ist das größte Geschenk am Leben zu sein und ich möchte nicht irgendwann fertig sein und denken, krass ich bin eigentlich nie über Level eins hinausgegangen.

00:25:04: Weil ich Angst hatte weil es anstrengend wurde und diese ganzen Herausforderungen die KI-Technologie mit sich bringt.

00:25:12: also das wir als Verband jetzt auch so viel kämpfen müssen, ist natürlich wenn du mir die Wahl geben würdest.

00:25:19: Also wenn ich nach dem entscheide was ich denke was gut für mich ist oder was ich gerne hätte dann würde ich wahrscheinlich sagen auch so ich muss jetzt nicht unbedingt jetzt gerade so drei Jahre lang mich irgendwie mit so einem Kram auseinandersetzen und kämpfen und ich würde vielleicht einfach viel lieber aufm Sofa sitzen in meinen Hund streicheln aber das ist ja genau das was es menschlich macht.

00:25:38: Es sind diese Überraschungen die uns Herausforderung fordern an denen wir eben wachsen wo wir dann kreativ denken finden können, Lösungen finden können.

00:25:46: Auch hier wieder unser Gespräch gerade ist ein Produkt dessen und ich glaube all das ist bei einer Wahrscheinlichkeitsmaschine nicht drin.

00:25:55: Ich habe mal einen Keynote darüber gehalten wie viel Unwahrscheinlichkeit in unserem Leben ist und allein in meinem Leben es so viel Unwascheinlichkeit gewesen dass ich an diesem Punkt stehe und das sind... Das ist was uns menschlich macht und deswegen nicht Es ist gut genug sondern Es muss richtig gut sein.

00:26:18: Ein sehr passendes Schlusswort.

00:26:20: Wusstet ihr eigentlich, dass es auch

00:26:22: von meiner

00:26:22: Stimme einen KI-Klon gibt?

00:26:25: Kurz informiert von Heiser Online habe ich früher moderiert.

00:26:28: Inzwischen wird das von meinem KI-Zwischen gesprochen.

00:26:31: Diese Stimme haben wir trainiert als ich anfing, das KI Update zu moderieren.

00:26:36: Aber

00:26:36: die Texte

00:26:37: für diese Stimme schreibt weiterhin

00:26:39: ein Mensch

00:26:40: damit es eben nicht nur

00:26:42: gut genug ist.

00:26:44: Alle Folgen von dem CT-Podcast Day Talk Tech sowie den Podcast Künstlerische Intelligenz von Anna-Sophia Lumpe findet ihr auf der

00:26:52: Podcastplattform

00:26:53: eurer

00:26:54: Wahl.

00:26:55: Und das war's für heute!

00:26:57: Die nächsten Deep Dive des KI Updates hört ihr wieder in zwei Wochen und es würde mich freuen, wenn ihr dann wieder dabei seid.

00:27:03: Bis dahin könnt ihr natürlich mit unserem kompakten KI Update jeden

00:27:07: Montag

00:27:08: Mittwoch

00:27:09: und Freitag auf dem Laufenden bleiben.

Neuer Kommentar

Dein Name oder Pseudonym (wird öffentlich angezeigt)
Mindestens 10 Zeichen
Durch das Abschicken des Formulars stimmst du zu, dass der Wert unter "Name oder Pseudonym" gespeichert wird und öffentlich angezeigt werden kann. Wir speichern keine IP-Adressen oder andere personenbezogene Daten. Die Nutzung deines echten Namens ist freiwillig.