KI-Stimme im Podcast: Was du sparst und was du dabei verlierst
Daniel Friesenecker

Von Daniel Friesenecker · Stand: Oktober 2026 · Lesezeit 7 Minuten
Besprechungsraum, zweiter Stock. Auf dem Bildschirm läuft eine Demo. Eine Stimme liest den Jahresrückblick vor, und sie klingt genau wie die Geschäftsführerin. Gleiche Tonlage, gleiche Pausen, sogar das kleine Räuspern vor den wichtigen Sätzen.
Die Geschäftsführerin sitzt daneben. Keinen dieser Sätze hat sie je gesagt.
Im Marketing wird gerechnet. Keine Aufnahmetermine mehr. Kein Nachsprechen. Keine Folge, die ausfällt, weil die Chefin auf Dienstreise ist.
So oder so ähnlich läuft diese Demo gerade in vielen Häusern. Und irgendwann fragt jemand: Wenn das genauso klingt wie sie, wozu braucht es sie dann noch?
Gute Frage. Um die geht es hier.
Kurz gesagt
Ein Unternehmenspodcast darf mit einer KI-Stimme sprechen. Bildet die Stimme eine echte Person nach, muss das seit 2. August 2026 nach Artikel 50 des EU AI Act dort offengelegt werden, wo Menschen den Inhalt hören. Strategisch ist eine geklonte Stimme für jeden Podcast riskant, dessen Wirkung auf Vertrauen in eine echte Person beruht: KI eignet sich für Transkript, Schnitt und Übersetzung als Text, nicht als Ersatz für die Stimme.
Darf ein Unternehmenspodcast mit einer KI-Stimme sprechen?
Ja. Bildet die Stimme eine echte Person nach, muss das seit 2. August 2026 offengelegt werden, und zwar dort, wo die Hörer es mitbekommen. Bei Audio heißt das: hörbar in der Folge, nicht versteckt in den Metadaten.
Damit ist die rechtliche Frage beantwortet. Die interessante fängt erst an.
Stell dir die Ansage vor, die dann am Anfang jeder Folge steht: „Diese Folge wurde mit einer KI-Stimme unseres Geschäftsführers erstellt.“ Was hört der Mensch am anderen Ende? Er hört: Unser Chef hatte keine Zeit für dich.
Das ist kein Rechtsproblem. Das ist ein Beziehungsproblem.
Was passiert mit dem Vertrauen, wenn die Stimme geklont ist?
Es bricht nicht sofort. Es bröckelt leise, und zwar genau dort, wo ein Podcast stärker ist als jeder andere Kanal.
Ein Podcast landet direkt im Ohr. Zwanzig, dreißig Minuten, oft mit Kopfhörern, beim Autofahren, beim Laufen, beim Kochen. Kaum ein anderes Medium kommt so nah an einen Menschen heran. Genau deshalb hört man so genau hin, ob da jemand meint, was er sagt.
Audio ist der Lügendetektor.
Man hört, ob jemand zögert, weil er nachdenkt. Ob er lacht, weil etwas wirklich lustig war. Ob die Stimme kurz wegkippt, weil das Thema wehtut.
Ich hab 2009 im Linzer Posthof Alfred Dorfer ein Mikrofon hingehalten, und meine Hand hat gezittert wie ein Presslufthammer. An meine Fragen erinnere ich mich nicht mehr. An das Zittern schon. Es war der ehrlichste Moment des Abends.
Eine geklonte Stimme zittert nicht. Sie zögert nur dort, wo jemand eine Pause eingebaut hat. Sie klingt nach dem Menschen und meint nichts. Niemand verliebt sich in eine glatte Oberfläche. Man rutscht darauf aus.
Für einen Industriebetrieb, der Fachkräfte sucht, oder eine Klinik, die Vertrauen in ihre Pflege braucht, ist das keine Stilfrage. Der Podcast existiert, weil jemand mit Namen und Stimme für etwas geradesteht. Ersetzt du die Stimme, steht niemand mehr gerade.
Wo hilft KI, ohne dass der Hörer es merken muss?
Überall dort, wo sie Arbeit hinter dem Mikrofon abnimmt und nicht davor. Transkript, Schnitt, Shownotes, Kapitelmarken, Rohentwürfe für Social Posts: Das darf eine Maschine machen. Der Hörer bekommt dadurch nicht weniger Mensch, sondern mehr, weil mehr Zeit fürs Gespräch bleibt.
Ich nutze KI jeden Tag in der Produktion. Wie das konkret aussieht, steht im Artikel Podcast KI: Was künstliche Intelligenz in der Produktion wirklich bringt.
Die Grenze ist einfach. Alles, was die Stimme vorbereitet, darf automatisiert werden. Die Stimme selbst nicht.
Bei Übersetzungen wird es knifflig. Eine englische Fassung mit KI-Stimme kann für ein international aufgestelltes Unternehmen sinnvoll sein. Ehrlicher ist oft der andere Weg: Die Folge bleibt im Original, dazu gibt es ein übersetztes Transkript und untertitelte Clips. Dann hört man den Menschen und versteht ihn trotzdem.
| Innovation | Was sie spart | Was sie an Vertrauen kostet | Wann ja |
|---|---|---|---|
| KI für Transkript und Schnitt | Stunden pro Folge | Nichts, der Hörer merkt es nicht | Immer, mit menschlicher Endkontrolle |
| Übersetzung als Text und Untertitel | Sprecher, Studio, Zeit | Wenig, die Originalstimme bleibt | Bei internationalem Publikum |
| KI-Stimme für Übersetzungen | Aufnahmen in jeder Sprache | Einiges, braucht Kennzeichnung und Zustimmung | Reine Info-Formate, klar gekennzeichnet |
| Geklonte Stimme der Führungskraft | Aufnahmetermine | Alles, worauf der Podcast gebaut ist | Praktisch nie |
| Interaktive Folgen mit Abzweigungen | Nichts, sie kosten mehr Produktion | Wenig, aber sie brechen das Nebenbeihören | Onboarding und Training |
Sind interaktive Podcasts die Zukunft für Unternehmen?
Für ein paar Einsatzbereiche ja, für Vertrauen und Marke kaum. Interaktive Podcasts lassen Hörer an bestimmten Stellen entscheiden, wie es weitergeht. Das passt zu Onboarding oder Schulungen, wo jemand ohnehin am Gerät sitzt und aktiv lernen soll.
Für alles andere arbeitet das Prinzip gegen die größte Stärke des Mediums. Menschen hören Podcasts, weil sie dabei nichts tun müssen. Im Auto, im Stau, beim Spazierengehen. Wer alle paar Minuten zum Handy greifen muss, um eine Abzweigung zu wählen, hört irgendwann gar nicht mehr.
Dazu kommt der Aufwand. Jede Abzweigung ist eine eigene Aufnahme, ein eigener Schnitt, eine eigene Freigabe. Die gängigen Plattformen spielen Folgen linear ab, für echte Verzweigungen braucht es Zusatztechnik.
Mein Rat für die meisten Unternehmen: Bevor du über verzweigte Folgen nachdenkst, schau, ob die normale Folge schon trägt. Eine Abzweigung macht eine langweilige Folge nicht spannend. Sie macht sie nur doppelt so teuer.
Welche Innovation bringt einem Unternehmenspodcast 2026 wirklich etwas?
Die unbequeme Antwort: keine technische. Je leichter Inhalte mit KI entstehen, desto wertvoller wird das, was keine KI liefern kann. Ein Mensch, der Verantwortung trägt und hörbar dazu steht.
Scroll mal durch LinkedIn. Die KI-Posts erkennst du nach drei Zeilen. Glatt, freundlich, austauschbar. Dein Publikum erkennt sie auch. Eine Folge, in der die Geschäftsführerin erzählt, welche Entscheidung sie letztes Jahr bereut hat, kann man nicht generieren. Die muss passieren.
Genau darauf baut mein eigener Podcast „Ehrlich gesagt“: Menschen, die Verantwortung tragen, erzählen, was man sonst nur backstage sagt. Kein Skript, keine Fangfragen. Technisch ist daran nichts neu. Kopieren lässt es sich trotzdem nicht.
Aus meiner Sicht ist die mutigste Entscheidung für 2026 keine neue Software. Es ist der Satz: Wir reden selbst. Auch wenn wir dabei mal stolpern.
Drei Fragen vor jeder neuen Podcast-Technik
1. Wer spricht danach? Wenn die Antwort nicht mehr „ein Mensch aus unserem Haus“ lautet, lass es.
2. Würden wir es den Hörern in der ersten Minute offen sagen? Wenn euch das unangenehm wäre, habt ihr eure Antwort.
3. Spart es Zeit hinter dem Mikrofon oder davor? Dahinter gern. Davor nicht.
Wann ist eine KI-Stimme völlig in Ordnung?
Damit kein falscher Eindruck entsteht: Ich bin kein KI-Gegner. Es gibt Fälle, in denen eine synthetische Stimme genau richtig ist.
1. Barrierefreiheit. Texte vorlesen lassen, damit Menschen mit Sehbehinderung sie hören können.
2. Reine Info-Formate. Ein täglicher Lagebericht oder eine Produktinfo, bei der niemand eine Beziehung erwartet und keine echte Person nachgebildet wird.
3. Übersetzungen. Für Märkte, in denen sonst niemand eure Folge versteht. Mit Zustimmung der Sprechenden und klar gekennzeichnet.
Wenn du einen Podcast willst, der vor allem Informationen verteilt und billiger sein soll als ein Newsletter: Dann ist eine KI-Stimme eine vernünftige Wahl. Nur ist das ein anderes Produkt als das, worum es hier geht.
Häufige Fragen
Muss ich eine KI-Stimme im Podcast kennzeichnen?
Wenn die Stimme eine echte Person nachbildet, ja. Seit 2. August 2026 gilt Artikel 50 des EU AI Act, der eine Offenlegung dort verlangt, wo Menschen den Inhalt wahrnehmen, bei Audio also hörbar in der Folge. Den Einzelfall klärst du am besten mit einer Rechtsberatung.
Darf ich meine eigene Stimme klonen lassen?
Mit deiner Zustimmung ja, bei den Stimmen anderer Menschen braucht es deren ausdrückliche Zustimmung. Ob es klug ist, ist eine andere Frage. Jede Folge, die nicht du sprichst, ist eine Folge, in der du nicht da bist.
Lohnt sich eine KI-Übersetzung meines Podcasts?
Für ein internationales Publikum kann sie sich lohnen, am ehrlichsten als übersetztes Transkript und untertitelte Clips. Eine KI-Stimme in der Zielsprache ist möglich, braucht aber Kennzeichnung und die Zustimmung der Sprechenden. Prüf vorher, ob in diesem Markt überhaupt jemand auf eure Folge wartet.
Brauchen interaktive Podcasts eine eigene Plattform?
Für echte Abzweigungen meistens ja, denn die großen Podcast-Plattformen spielen Folgen linear ab. Einfache Varianten lassen sich mit Kapitelmarken oder getrennten Kurzfolgen bauen. Für ein Onboarding kann das reichen.
Ob ein Unternehmen nach Menschen klingt, hört man in der ersten Minute.
Der PodSignal-Check zeigt dir, wo dein Unternehmen heute schon hörbar ist und wo es noch nach Broschüre klingt.
Über den Autor
Daniel Friesenecker ist Hörbarmacher und podcastet seit 2006. Über 1.000 Episoden, European Podcast Award, diplomierter systemischer Coach und Autor des Buchs „Hörbar echt!“. Im TeddyLab in Linz baut er Organisationen, deren wichtigstes Kapital Vertrauen ist, ihr eigenes Medium. Mehr über Daniel
Damit die Guten nicht die Leisen bleiben.

