Anzeige
Anzeige
Anzeige
Anzeige
Lesedauer 3 Min.

Microsoft: So erschreckend sind die neuen KI-Stimmen

Eine dreisekündige Sprachprobe genügt – und eine neue künstliche Intelligenz von Microsoft ahmt praktisch jede Stimme glaubwürdig nach. So könnten sich Podcasts einsprechen lassen, ohne dass der Autor ans Mikrofon muss.
© W&V

Microsoft: So erschreckend sind die neuen KI-Stimmen

Spricht da in einer Rede tatsächlich Olaf Scholz – oder imitiert künstliche Intelligenz (KI) die Stimme des Kanzlers beinahe perfekt? Diese Frage wird künftig drängender denn je. Denn Microsoft hat ein neues KI-Modell namens "VALL-E" vorgestellt, das nach Angaben des US-Konzerns mit einer nur dreisekündigen Sprachprobe jede Stimme glaubwürdig nachahmen kann. Dabei sollen sich auch Emotionen und typischer Tonfall eines Menschen überzeugend imitieren lassen. Auf einer Demo-Seite bietet Microsoft zahlreiche Beispiele zum Nachhören an, deren Ähnlichkeit zwischen Original und "Fälschung" tatsächlich gespenstisch bis erschreckend wirkt.

Viele ethische Fragen bleiben

Die Entwickler wollen "VALL-E" beispielsweise dazu verwenden, um aus schriftlichen Texten gesprochene Inhalte mit der Originalstimme des Autors zu erzeugen. So könnten sich beispielsweise Podcasts einsprechen lassen, ohne dass die Autorin oder der Autor überhaupt ans Mikrofon muss. In einem anderen Szenario ließen sich Fehler in Reden oder in Videos nachträglich korrigieren. Microsoft hat die KI mit 60.000 Stunden Sprachbeispielen von über 7.000 Sprecherinnen und Sprechern trainiert, so ArsTechnica.

Maßnahmen gegen Missbrauch

Um Missbrauch zu vermeiden, hat Microsoft den Quellcode von "VALL-E" bisher nicht veröffentlicht. Und die Frage, inwieweit man einer Stimme künftig noch vertrauen kann, muss dringend geklärt werden. Das räumt auch Microsoft in einem "ethischen Statement" ein: "Die Experimente in dieser Arbeit wurden unter der Annahme durchgeführt, dass der Benutzer des Modells der Zielsprecher ist und vom Sprecher genehmigt wurde." Falls das nicht der Fall ist, müsse die Software Funktionen erhalten, die Missbrauch erschweren oder ganz verhindern.

Das sind die Themen von TechTäglich am 10. Januar 2023:

Die Cookiekalypse hält die Branche in Atem. Besser, man hat eine gute First-Party-Data-Strategie. Wie man die entwickelt, lernst du im W&V Executive Briefing.

Kennst du eigentlich schon unser KI-Update? Einmal pro Woche die wichtigsten Veränderungen zu KI im Marketing. Einordnung, Strategie, News, direkt in dein Postfach

Wie funktioniert eigentlich Tiktok? Einen schnellen und umfassenden Überblick gibt dir die aktuelle Ausgabe des W&V Executive Briefing zum Thema Tiktok.

Neueste Beiträge

Kommentar
WuV Community Icon Punica-Aus: Retro alleine ist kein Erfolgsgarant
Das Comeback brachte Punica zurück in die Schlagzeilen, aber nicht in die Einkaufskörbe. Die Marke ist ein Beispiel dafür, dass Nostalgie zwar Aufmerksamkeit schafft, aber ohne nachhaltige Werbung zum Scheitern verurteilt ist. Was bei Punica sonst noch schiefging. 
5 Minuten
10. Aug 2026
Sport
WuV Community Icon Die teuerste Fußballerin der Welt – und ihr Marketingpotenzial bleibt liegen
Ein unterbewerteter Markt mit überdurchschnittlichem Potenzial: Frauenfußball wächst schneller als viele andere Sportarten – nur die Vermarktung hinkt hinterher. Verena Gründel, Director Brand & Communications der DMEXCO, zeigt am Beispiel von Klara Bühl, warum Marken jetzt genauer hinschauen sollten.
5 Minuten
Interview
WuV Community Icon Warum sichtbare KI-Werbung für Marken zum Vertrauensrisiko wird
Eine aktuelle Verve-Umfrage zeigt Skepsis gegenüber KI-generierter Werbung, zugleich aber Offenheit für Empfehlungen von Chatbots. CEO Remco Westermann erklärt im Interview mit W&V, wann der Einsatz Vertrauen kostet.
8 Minuten
11. Aug 2026

Das könnte dich auch interessieren

Jetzt mitmachen
W&V sucht die „AI Leaders 2026“
Wer sind die Pioniere beim intelligenten Einsatz von AI im Marketing? Sag’s uns! - bis zum 07.08.2026. Du kannst dich selbst oder jemand anders vorschlagen.
2 Minuten
24. Jul 2026
Künstliche Intelligenz und Ethik
WuV Community Icon Wenn Empathie-Simulation zur Gefahr wird: Tech-Giganten im Visier der Justiz
Die rasante Evolution generativer Sprachmodelle offenbart zunehmend ihre gesellschaftlichen Schattenseiten. Ein profilierter US-Anwalt, der derzeit Opfer von sogenannter „KI-Psychose“ vertritt, richtet nun eine drastische Warnung an die Technologiebranche: Die intime, unregulierte Bindung zwischen vulnerablen Nutzern und Chatbots berge ein massives, bislang massiv unterschätztes Eskalationspotenzial.
3 Minuten
16. Mär 2026
US Supreme Court Urteil
WuV Community Icon Warum KI niemals träumt: Das Urheberrecht und die Seele der Kreativität
Der Supreme Court verweigert maschinell erzeugten Bildern das Urheberrecht. Was wie eine juristische Formalie wirkt, offenbart bei genauerer Betrachtung das tiefste Geheimnis unserer Branche: Wahre Kreativität ist untrennbar mit der menschlichen Existenz und all ihren Unzulänglichkeiten verbunden.
4 Minuten
9. Mär 2026
Anzeige
Anzeige
Anzeige
Anzeige
Anzeige