Zum Inhalt
RAUSCHWERKVERLAG · BERLIN
Menü
Aus Ideen werden Bücher   ·   Veröffentlichung nach Auswahl   ·   80 % für Autorinnen und Autoren   ·  
Ihr Buch beginnt mit einem Gespräch.030 92101145KI-Vorzimmer HeleneGespräch vereinbaren

Das Verlagswissen

Start › Wissen › Hörbuch mit KI-Stimme: Muss ich das kennzeichnen?

Hörbuch mit KI-Stimme: Muss ich das kennzeichnen?

Redaktion: Rauschwerk-Team · 30. September 2026 · 15 Min. Lesezeit

Redaktion: Rauschwerk-Team · Quellenstand: 30. September 2026.

Nicht pauschal. Art. 50 Abs. 4 der EU-KI-Verordnung verlangt seit dem 2. August 2026 einen für Hörerinnen und Hörer wahrnehmbaren Hinweis nur, wenn die KI-Stimme ein Deepfake ist, etwa ein Stimmklon eines echten Menschen oder, je nach Kontext, eine Stimme, die man für eine echte Sprecherin halten würde. Fast alle Hörbuchplattformen verlangen zusätzlich eine eigene Angabe. AI Act: Artikel 50 · Leitlinien der EU-Kommission.

Dieser Beitrag informiert allgemein und ersetzt keine Rechtsberatung. Stand: 30. September 2026. Die Auslegung des AI Act ist noch im Fluss, und Plattformen können ihre Regeln jederzeit ändern.

Eine Autorin hat ihren Roman als deutsches E-Book bei KDP veröffentlicht. Die Schaltfläche für ein Hörbuch mit virtueller Stimme erscheint nicht, weil Deutsch dort keine unterstützte Sprache ist. Also vertont sie das Buch mit einem KI-Werkzeug wie ElevenLabs. Kurz vor dem Upload liest sie in einer Autorengruppe: „Seit August muss jede KI-Stimme gekennzeichnet werden, sonst drohen Millionenstrafen.“ Stimmt das?

So pauschal nicht. Beim Hörbuch laufen drei Fragen durcheinander: was das Gesetz verlangt, welcher Hinweis im Hörbuch selbst sinnvoll ist und was die Plattform beim Upload abfragt. Dieser Leitfaden trennt die drei Ebenen und geht vier typische Fälle durch. Die Grundlagen zu Artikel 50 erklärt ausführlich der Beitrag KI-generiertes Buchcover kennzeichnen. Hier geht es nur um Stimme und Audio.

Drei Ebenen, die beim KI-Hörbuch verwechselt werden

Hinter der Frage „Muss ich mein KI-Hörbuch kennzeichnen?“ stecken drei verschiedene Pflichten mit verschiedenen Adressaten.

EbeneWer verlangt es?Wer muss handeln?Wo landet der Hinweis?Gilt für jede KI-Stimme?
Maschinenlesbare MarkierungAI Act, Art. 50 Abs. 2Anbieter des Werkzeugs, z. B. des Sprach- oder Klon-GeneratorsIn der Audiodatei (z. B. Wasserzeichen, Metadaten)Betrifft das Werkzeug, nicht Ihre Produktion
Wahrnehmbare OffenlegungAI Act, Art. 50 Abs. 4Betreiber bei beruflicher Nutzung, in der Regel Autorin, Autor oder VerlagFür Hörende wahrnehmbar, am InhaltNein, nur bei Deepfakes
PlattformangabeDie jeweilige PlattformWer das Hörbuch hochlädtUpload-Formular, Sprecherfeld, BeschreibungBei fast allen Plattformen ja, sobald die Stimme synthetisch ist

Beim Cover verlangt meist nur KDP eine Angabe, und die sieht die Leserschaft nicht. Beim Hörbuch ist es umgekehrt: Die Plattformen sind strenger und sichtbarer als das Gesetz. Die folgenden Abschnitte erklären jede Zeile.

Was Art. 50 für Hörbücher regelt (Kurzfassung)

Die Transparenzpflichten gelten seit dem 2. August 2026 (Art. 113 AI Act). Die Übergangsfrist bis zum 2. Dezember 2026 aus dem neuen Art. 111 Abs. 4 betrifft nur Anbieter älterer Systeme und nur deren maschinenlesbare Markierung, nicht die Offenlegungspflicht der Betreiber. Einzelheiten, auch zum Digital Omnibus, stehen im Cover-Leitfaden im Abschnitt zum AI Act.

Audio ist ausdrücklich erfasst. Art. 50 Abs. 2 nennt KI-Systeme, die „synthetische Audio-, Bild-, Video- oder Textinhalte erzeugen“. Und ein Deepfake ist nach Art. 3 Nr. 60 ein durch KI erzeugter oder manipulierter „Bild-, Ton- oder Videoinhalt“, der wirklichen Personen, Gegenständen, Orten, Einrichtungen oder Ereignissen ähnelt und einer Person fälschlicherweise als echt oder wahrheitsgemäß erscheinen würde. Art. 50 AI Act · konsolidierte Fassung auf EUR-Lex.

Beruflich oder privat? Die Deepfake-Pflicht trifft nur Betreiber, die KI beruflich nutzen (Leitlinien Rn. 112). Als beruflich gilt laut Leitlinien jede Tätigkeit, mit der jemand regelmäßig wirtschaftlichen Nutzen erzielt (Rn. 19). Wer Hörbücher verkauft, sollte davon ausgehen, dass das zutrifft. Leitlinien der Kommission C(2026) 5054 (PDF, Englisch).

Und der gesprochene Text? Für KI-Text gilt eine eigene Regel, die nur Veröffentlichungen zu Angelegenheiten von öffentlichem Interesse betrifft. KI-generierte Fantasy-Romane nennen die Leitlinien ausdrücklich als Beispiel, das nicht darunter fällt. Mehr dazu im Beitrag Art. 50 und KI-Texte.

Wer ist beim Hörbuch Anbieter, wer Betreiber?

Anbieter ist das Unternehmen hinter dem Sprach- oder Klon-Werkzeug. Betreiber ist, wer entscheidet, das Werkzeug einzusetzen, und bestimmt, wie es genutzt wird (Rn. 12). Wer sein Buch selbst mit einem KI-Werkzeug vertont, ist deshalb in der Regel Betreiber. Plattformen, die fremde Inhalte nur verbreiten, sind laut Leitlinien keine Betreiber (Rn. 16).

Offen ist die Lage bei Werkzeugen, die eine Plattform selbst betreibt, etwa KDP Virtual Voice, die Auto-Narration von Google Play Books oder die Digital Narration von Apple Books. Die Leitlinien regeln diese Konstellation nicht ausdrücklich. Nach unserer Einschätzung liegt nahe: Die Plattform ist Anbieter, und wer Stimme und Veröffentlichung verantwortet, ist Betreiber. Das ist eine Einschätzung, keine Aussage der Leitlinien.

Für längere Vertriebsketten sagen die Leitlinien: Betreiber sollen verhältnismäßige Maßnahmen treffen, damit ihr Hinweis beim Publikum ankommt, zum Beispiel über Vertragsbedingungen mit Vertriebspartnern (Rn. 12). Praktisch heißt das: Füllen Sie die Felder der Plattformen und Distributoren sorgfältig aus.

Ist meine KI-Stimme ein Deepfake? Vier Fälle

Die Leitlinien prüfen einen Deepfake anhand von vier Kriterien, die alle erfüllt sein müssen (Rn. 113): eine deutliche Ähnlichkeit, mit etwas Existierendem oder plausibel Möglichem, mit Personen, Objekten, Orten, Lebewesen oder Ereignissen, und der falsche Anschein von Echtheit. Die Kriterien im Detail erklärt der Cover-Leitfaden am Beispiel des Bildes.

Für Audio sind zwei Klarstellungen wichtig. „Personen“ umfasst laut Leitlinien auch persönliche Merkmale wie die Stimme sowie realistische KI-Avatare und -Personas (Rn. 113 iii). Und „Echtheit“ meint auch die Frage, ob echte Menschen beteiligt waren (Rn. 113 iv). Maßgeblich sind der Gesamteindruck, der Verbreitungsweg und die Erwartungen des Publikums. Eine Täuschungsabsicht ist nicht nötig (Rn. 114).

Fall 1: Stimmklon eines echten Menschen

Klingt die KI-Stimme wie eine bestimmte, existierende Person, etwa eine bekannte Sprecherin, ein Prominenter oder eine verstorbene Person, liegt in aller Regel ein Deepfake vor. Die Leitlinien nennen als Beispiel ausdrücklich KI-Audio mit geklonten Stimmen der regelmäßigen Moderatoren eines Zeitungs-Podcasts. Dann besteht die Hinweispflicht nach Art. 50 Abs. 4, bei erkennbar fiktionalen Werken in abgeschwächter Form (dazu unten).

Unabhängig vom AI Act brauchen Sie die Einwilligung der Person. Die Leitlinien betonen, dass Rechte Dritter auch bei künstlerischen Deepfakes gewahrt bleiben müssen (Rn. 124, 129). Ein Beispiel aus Deutschland: Das LG Berlin II hat entschieden, dass eine KI-Nachahmung der Stimme des Synchronsprechers Manfred Lehmann ohne Einwilligung sein Persönlichkeitsrecht verletzte. Er erhielt eine fiktive Lizenzgebühr (Urteil vom 20.08.2025, Az. 2 O 202/24). Bericht auf LTO. Ein Kennzeichen macht eine unerlaubte Nutzung nicht erlaubt.

Sonderfall: Sie klonen Ihre eigene Stimme

Diesen Fall behandeln die Leitlinien nicht ausdrücklich. Die Stimme gehört einer existierenden Person, und Hörende dürften annehmen, die Autorin oder der Autor habe selbst gelesen. Das spricht dafür, dass auch hier ein Deepfake vorliegen kann. Geklärt ist das nicht. Weil ein Hinweis wenig kostet, empfehlen wir die Offenlegung, etwa: „Gelesen von einer KI-Version der Stimme der Autorin.“

Auf Plattformseite ist die Sache eindeutiger. Voices by INaudio stuft auch den Klon der eigenen Stimme als digitale Vertonung ein. Solche Titel dürfen dort nicht als „Human Narrated“ eingereicht werden. Voices by INaudio: FAQ zur Digital Voice Narration.

Fall 2: Realistische generische KI-Stimme

Das ist der eigentliche Streitfall: eine Standardstimme eines KI-Werkzeugs, die keiner bestimmten Person gehört, aber natürlich klingt. Die Rechtslage ist hier offen.

Für eine Pflicht spricht: Nach den Leitlinien genügt es, wenn etwas plausibel existieren könnte, und „Personen“ umfasst realistische KI-Personas und Stimmen (Rn. 113 ii und iii). Nehmen Hörende an, ein Mensch habe gelesen, kann der falsche Anschein von Echtheit vorliegen. Der Sprecherverband VDS hält deshalb nach eigener Auffassung jede Form von synthetischem Audio für kennzeichnungspflichtig, die authentisch erscheinen kann. VDS zur Kennzeichnungspflicht.

Dagegen spricht: Die Leitlinien führen unter den Beispielen, die keine Deepfakes sind, ausdrücklich auf: „AI voice replication for fictional characters (e.g., for audiobooks, games or animation) when there is no deception as to the identity of the narrators“. Sinngemäß übersetzt: KI-Stimmen für fiktive Figuren, etwa in Hörbüchern, Spielen oder Animationen, wenn nicht über die Identität der Sprechenden getäuscht wird. Das Beispiel spricht von Stimmen für fiktive Figuren. Ob es auch eine generische Erzählstimme für das ganze Buch abdeckt, sagen die Leitlinien nicht ausdrücklich. Die Radiozentrale sieht generische KI-Stimmen laut VDS-Bericht regelmäßig nicht als Deepfake, solange nicht der Eindruck entsteht, eine bestimmte reale Person spreche. Sie betont aber, dass Inhalt und Kontext entscheiden.

Der Kontext zählt: Die Bewertung richtet sich nach Inhalt, Verbreitungsweg und Erwartungen des Publikums (Rn. 114, 115). Steht schon im Shop sichtbar eine Angabe wie „Synthesised voice“ im Sprecherfeld, ist eine Täuschung über die Sprecheridentität nach unserer Einschätzung unwahrscheinlicher. Die Leitlinien sagen dazu nichts.

Fazit für die Praxis: Die Rechtslage ist offen, ein Hinweis kostet fast nichts, und die Plattformen verlangen ohnehin eine Angabe. Wir empfehlen deshalb, eine realistische KI-Stimme zu kennzeichnen, und zwar dort, wo Hörende es vor dem Hören sehen oder hören.

Fall 3: Erkennbar synthetische Stimme

Klingt die Stimme hörbar künstlich, fehlt der falsche Anschein von Echtheit (Kriterium iv). Dann liegt kein Deepfake vor, und Art. 50 Abs. 4 verlangt keinen Hinweis. Die Plattformangabe bleibt trotzdem Pflicht.

Fall 4: KI nur als Technik

Wer eine menschliche Aufnahme mit KI entrauscht, normalisiert oder komprimiert, erzeugt keinen Deepfake. Die Leitlinien nennen als Nicht-Beispiel eine Radiosendung, bei der technische Audioparameter angepasst werden, etwa Lautstärke, Rauschunterdrückung und Kompression, ohne die gesprochenen Worte oder die Sprechweise zu verändern (Rn. 116 und Beispielliste).

Ein Grenzfall sind Korrekturen per Stimmklon: Einzelne Wörter einer menschlichen Aufnahme werden mit einer KI-Version der Sprecherstimme ersetzt. Das verändert die gesprochenen Worte. Die Leitlinien zählen die „Synthese realistischer Sprache in der Stimme einer bestimmten Person“ zu den Änderungen, die der Anbieter nach Abs. 2 zu markieren hat (Rn. 92). Ob dadurch schon ein Deepfake entsteht, ist eine Frage des Einzelfalls. Solche Korrekturen setzen die Einwilligung der Sprecherin oder des Sprechers voraus. Im Zweifel legen Sie sie offen. Als Orientierung, nicht als Rechtsmaßstab: Die britische Branchenrichtlinie der Publishers Association empfiehlt eine Kennzeichnung, wenn mehr als 10 Prozent einer Stimme mit KI erzeugt wurden. Publishers Association: AI Narration Naming Guidelines (PDF, Englisch).

SituationDeepfake nach Art. 50 Abs. 4?Hinweis empfohlen?
Klon einer fremden, echten StimmeJa, in aller RegelJa, dazu Einwilligung nötig
Klon der eigenen StimmeUnklar, eher jaJa
Realistische generische KI-StimmeUmstritten, kontextabhängigJa (Plattformen verlangen es ohnehin)
Hörbar synthetische StimmeNeinPlattformangabe ja
Nur Entrauschen, Pegel, SchnittNeinNein
Einzelne Wörter per Stimmklon ersetztEinzelfallIm Zweifel ja, nur mit Einwilligung

Die Tabelle verbindet Leitlinien und unsere Einschätzung. Maßgeblich ist der konkrete Fall.

Wenn ein Hinweis nötig ist: wo und wie im Hörbuch

Nach Art. 50 Abs. 5 muss die Information klar und unterscheidbar sein, spätestens bei der ersten Wahrnehmung gegeben werden und barrierefrei sein. Ein Hinweis, der leicht überhört oder übersehen wird, etwa nur in Nutzungsbedingungen oder tief in Menüs, genügt laut Leitlinien nicht (Rn. 142, 143). Auf das Wasserzeichen des Werkzeugs können Sie sich nicht verlassen. Der Hinweis muss für Menschen wahrnehmbar sein, die Leitlinien sprechen von „visible or audible labels“, also sichtbaren oder hörbaren Hinweisen (Rn. 117).

Was der Praxisleitfaden der Kommission vorsieht

Konkreter wird der Verhaltenskodex zur Kennzeichnung KI-generierter Inhalte (Code of Practice) vom Juni 2026. Er ist freiwillig. Die Kommission hat ihn aber als angemessenes Mittel bestätigt, die Pflichten zu erfüllen. Code of Practice: Übersicht der Kommission · Kodex als PDF (Englisch). Für Audio sieht er vor:

Roman oder Sachbuch?

Die Erleichterung für erkennbar fiktionale Werke ist eng auszulegen. Ist die Natur des Inhalts unklar oder kommen informative und kreative Elemente zusammen, gilt der strengere Standard (Rn. 122). Für die Praxis heißt das nach unserer Einschätzung: Beim Roman genügt eher der dezente Weg über Beschreibung und Ansage. Beim Sachbuch oder Ratgeber setzen Sie besser einen klaren gesprochenen Hinweis an den Anfang.

Reicht ein Impressum am Ende?

tolino media schlägt vor, das Impressum eines Hörbuchs als eigenen Track einzusprechen, zum Beispiel am Ende. tolino media: Impressum im Hörbuch. Was allgemein in ein Impressum gehört, erklärt unser Leitfaden zum Buchimpressum. Für einen Deepfake dürfte ein Hinweis nur am Ende aber eher nicht genügen, weil er spätestens bei der ersten Wahrnehmung kommen muss. Wir empfehlen deshalb: kurze Ansage am Anfang, Impressum-Track am Ende zusätzlich. Ob beim erkennbar fiktionalen Werk die Absage allein reicht, ist offen. Der Kodex nennt An- und Absage zwar als Beispiel, verlangt aber zugleich einen Hinweis spätestens bei der ersten Wahrnehmung.

Formulierungsbeispiele

  • Ansage am Anfang (gesprochen): „Dieses Hörbuch wird von einer KI-generierten Stimme gelesen.“
  • Stimmklon mit Einwilligung: „Gelesen von einer KI-Stimme, die mit Einwilligung von [Name] auf Grundlage ihrer Stimme erstellt wurde.“
  • Eigene Stimme: „Gelesen von einer KI-Version der Stimme der Autorin.“
  • Beschreibungstext: „Dieses Hörbuch wird von einer synthetischen (KI-generierten) Stimme gelesen.“
  • Sprecherfeld: die Werte, die die Plattform vorgibt. Die britische Branchenrichtlinie empfiehlt „AI Voice“ bzw. „Authorized Voice Replica“.

Und Hörbücher von vor August 2026?

Deepfakes, die vor dem 2. August 2026 erzeugt wurden, müssen nach den Leitlinien nicht nachträglich gekennzeichnet werden. Die Kommission ermutigt aber dazu, soweit das ohne unverhältnismäßigen Aufwand möglich ist (Rn. 154). Die Regeln der Plattformen gelten unabhängig davon.

Was die Plattformen verlangen

Anders als beim Cover fragen fast alle Hörbuchplattformen ausdrücklich nach einer synthetischen Stimme. Die Übersicht fasst die öffentlichen Hilfeseiten zusammen.

PlattformKI-Stimme erlaubt?Kennzeichnung: wer und wieDeutsch?
ACX (Audible, eigener Upload)Grundsätzlich nein, nicht autorisierte KI- oder TTS-Aufnahmen sind laut übereinstimmenden Wiedergaben der Einreichungsregeln untersagt––
ACX Voice Replica (Beta, nur USA, auf Einladung)Ja, Klon der eigenen SprecherstimmePlattform, im Sprecherfeld von Listing und Detailseite–
KDP Virtual Voice (Beta, auf Einladung)Ja, Amazons eigene computergenerierte StimmenPlattform; im Shop nach Beobachtungen als Sprecher „Virtual Voice“ angegebenNein
Spotify for AuthorsJa, z. B. von Google Play Books oder ElevenLabsSie wählen beim Upload „This audiobook uses digital voice narration“, Spotify ergänzt einen Satz in der Beschreibung. Keine Weitergabe an Referral-PartnerKeine Einschränkung genannt
Voices by INaudioJa, nur als unverändertes LPF-Paket von Google Play Books, ElevenLabs oder Spoken PressPlattform setzt die Sprecherangabe automatisch und ergänzt einen Hinweis in der Beschreibung. Auch der Klon der eigenen Stimme gilt als digitale Vertonung. Vertrieb nur an teilnehmende HändlerKeine Angabe
Google Play BooksJa, als Auto-Narration aus dem EPUB oder als eigenes KI-HörbuchSie geben im Sprecherfeld an, ob ein Mensch oder eine synthetische Stimme liestJa, Auto-Narration auch für Verlage mit Sitz in Deutschland, Österreich und der Schweiz
Apple Books Digital NarrationJa, Apple produziert selbst, über Partner wie Draft2DigitalPlattform: „Narrated by Apple Books“Nein, nur Englisch
Kobo Writing LifeJaSie tragen als Sprecher „Synthesised voice – male“, „– female“ oder „– unspecified“ einKeine Angabe
tolino mediaJaSie sind laut FAQ zur Kennzeichnung der KI-Inhalte und KI-Stimmen verpflichtet. Die Form ist nicht festgelegtJa
Storytel (Verlagsportal)Ja, bei hoher SprachqualitätSie kennzeichnen KI-Beteiligte im Metadatenfeld, z. B. „Name (AI voice)“ oder „Name (Authorized voice replica)“. Ungekennzeichnete KI-Inhalte kann Storytel entfernenKeine Angabe
BookBeatOffenbar ja, eine öffentliche Richtlinie haben wir nicht gefundenBeobachtet: Sprecherangabe „Synthetic Voice“ auf der SprecherseiteKeine Angabe

Stand: 30. September 2026. Plattformen ändern ihre Regeln häufig. Prüfen Sie vor dem Upload die verlinkte Hilfeseite.

Audible: ACX nein, Virtual Voice ja

Wer über ACX selbst ein Hörbuch zu Audible bringen will, braucht nach den ACX-Einreichungsregeln grundsätzlich eine menschliche Stimme. Nicht autorisierte KI- und TTS-Aufnahmen sind dort untersagt. Die ACX-Hilfeseite lässt sich nur im Browser mit JavaScript anzeigen. Den Wortlaut haben wir deshalb nur über übereinstimmende Wiedergaben Dritter nachvollzogen. Prüfen Sie ihn vor dem Upload selbst.

Im Amazon-Kosmos gibt es zwei Ausnahmen. Die erste ist KDP Virtual Voice, Amazons eigenes Werkzeug mit computergenerierter Sprache, das derzeit kein Deutsch unterstützt. Wann ein E-Book dafür in Frage kommt, erklärt Hörbuch mit virtueller Stimme bei KDP. Die zweite ist eine Beta für Stimmklone, die in den USA ausgewählte Sprecherinnen und Sprecher von ihrer eigenen Stimme erstellen. Deren Titel werden laut ACX im Sprecherfeld gekennzeichnet.

tolino media weist selbst darauf hin, dass einige Vertriebskanäle, etwa Audible, keine Hörbücher mit KI-Stimme listen. Das betrifft alle, die über einen Distributor breit vertreiben wollen.

Übrigens: Die KI-Abfrage in den KDP-Inhaltsrichtlinien nennt Text, Bilder und Übersetzungen, Audio wird dort nicht erwähnt. KDP-Inhaltsrichtlinien.

Wege für deutschsprachige KI-Hörbücher

Nur zur Orientierung: Die Auto-Narration von Google Play Books unterstützt Deutsch und steht Verlagen mit Sitz in Deutschland offen. Google Play Books: Auto-Narration. KDP Virtual Voice und Apple Digital Narration unterstützen derzeit kein Deutsch. Weitere Wege, deren Bedingungen Sie im Einzelfall prüfen sollten, sind Spotify for Authors, Voices by INaudio, Kobo Writing Life und tolino media.

Plattformangabe und Gesetzespflicht sind zwei Dinge

Ein Häkchen bei Spotify oder ein Eintrag im Sprecherfeld bei Kobo erfüllt die Regel der Plattform. Ob es auch einen Deepfake-Hinweis nach Art. 50 Abs. 4 und 5 ersetzt, hängt davon ab, ob Hörende ihn vor dem Hören wahrnehmen. Bei einem Satz in der Beschreibung ist das eher der Fall, bei einem Metadatenfeld, das nicht überall angezeigt wird, eher nicht. Beim Stimmklon einer echten Person setzen Sie zusätzlich eine Ansage ins Audio.

Umgekehrt gilt: Auch wenn der AI Act keinen Hinweis verlangt, etwa bei einer hörbar synthetischen Stimme, bleibt die Plattformangabe Pflicht. Wer bei Voices by INaudio ein KI-Hörbuch als „Human Narrated“ einreicht, riskiert laut FAQ die Ablehnung oder Entfernung des Titels, bei wiederholter oder absichtlicher Falschangabe auch Einschränkungen bis zur Schließung des Kontos.

Was droht bei Verstößen?

Für Verstöße gegen Art. 50 sieht Art. 99 Abs. 4 AI Act Geldbußen von bis zu 15 Millionen Euro oder 3 Prozent des weltweiten Jahresumsatzes vor. Für kleine und mittlere Unternehmen gilt jeweils der niedrigere Betrag. In Deutschland ist nach § 2 KI-MIG grundsätzlich die Bundesnetzagentur zuständig. Art. 99 AI Act · § 2 KI-MIG. Einzelheiten und Einordnung stehen im Cover-Leitfaden unter „Was droht bei Verstößen?“.

Praktisch naheliegender sind zwei andere Folgen: Plattformen können Titel entfernen oder Konten einschränken, und beim Klon einer fremden Stimme ohne Einwilligung drohen zivilrechtliche Ansprüche, wie das Urteil des LG Berlin II zeigt.

Checkliste: KI-Hörbuch in sechs Fragen prüfen

  1. Stammt die Stimme ganz oder teilweise aus einer KI? Ja: auf jeder Plattform als synthetische Stimme angeben.
  2. Ist es der Klon einer echten Person, auch Ihrer eigenen? Ja: Einwilligung schriftlich sichern, am Anfang hörbar offenlegen und in der Beschreibung nennen.
  3. Klingt eine generische KI-Stimme so echt, dass Hörende einen Menschen vermuten würden? Ja: Hinweis in der Beschreibung und kurze Ansage am Anfang.
  4. Roman oder Sachbuch? Beim erkennbar fiktionalen Werk ist ein dezenter Hinweis möglich, beim Sachbuch setzen Sie ihn besser klar an den Anfang.
  5. Wurde KI nur zum Entrauschen, Normalisieren oder Schneiden genutzt? Dann liegt kein Deepfake vor. Wurden Wörter per Stimmklon ersetzt: Einzelfall, Einwilligung einholen, im Zweifel offenlegen.
  6. Ist alles dokumentiert? Halten Sie je Ausgabe Werkzeug, Stimme, Einwilligungen und Plattformangaben fest. Wie ein Entstehungsprotokoll aussehen kann, zeigt KI-Inhalte bei KDP angeben.

So gehen wir bei Rauschwerk damit um

Bei Rauschwerk besprechen wir die Stimme eines Hörbuchs und ihre Kennzeichnung ausdrücklich mit unseren Autorinnen und Autoren. Die Angabe gegenüber der jeweiligen Plattform und die Frage, ob ein gesetzlicher Hinweis nötig ist, behandeln wir als zwei getrennte Prüfungen. Wie wir mit KI in der Buchproduktion arbeiten, beschreibt die Seite Qualität & KI. Den Weg vom Manuskript zur Hörfassung zeigt Hörbuch erstellen. Wenn Sie ein Hörbuchprojekt mit uns besprechen möchten, stellen Sie uns Ihre Buchidee vor. Eine Rechtsberatung ersetzt das nicht.

Hinweis: Dieser Beitrag informiert allgemein und ersetzt keine Rechtsberatung. Er gibt den Stand vom 30. September 2026 wieder. Die Auslegung des AI Act ist noch im Fluss, und Plattformen können ihre Regeln jederzeit ändern. Beim Stimmklon einer echten Person lassen Sie den Einzelfall bitte rechtlich prüfen.

Primärquellen: Art. 50 AI Act · Art. 99 AI Act · AI Act, konsolidierte Fassung (EUR-Lex) · VO (EU) 2026/1744 · Kommissions-Leitlinien C(2026) 5054 vom 20.07.2026 · Übersichtsseite der Kommission · Code of Practice zur Kennzeichnung KI-generierter Inhalte · § 2 KI-MIG · Spotify for Authors · Voices by INaudio · Google Play Books · Kobo Writing Life · tolino media · Storytel · Apple Books · ACX Voice Replica · KDP Virtual Voice.

Häufige Fragen

Muss ich ein Hörbuch mit KI-Stimme kennzeichnen?

Nach dem AI Act nur, wenn die Stimme ein Deepfake ist, etwa ein Stimmklon eines echten Menschen oder eine Stimme, die Hörende für eine echte Sprecherin halten würden. Ob generische KI-Stimmen darunter fallen, ist umstritten. Fast alle Hörbuchplattformen verlangen ohnehin eine Angabe als synthetische Stimme.

Ist eine KI-Stimme im Hörbuch ein Deepfake?

Nicht automatisch. Die Leitlinien der EU-Kommission nennen KI-Stimmen für fiktive Figuren in Hörbüchern als Beispiel für keinen Deepfake, solange über die Identität der Sprechenden nicht getäuscht wird. Ein Klon einer echten Stimme ist dagegen in aller Regel ein Deepfake.

Darf ich meine eigene Stimme klonen und mein Hörbuch damit einlesen?

Ja, sofern die Plattform das zulässt. Ob das ein Deepfake ist, klären die Leitlinien nicht ausdrücklich. Ein Hinweis wie „gelesen von einer KI-Version der Stimme der Autorin“ ist deshalb ratsam. Voices by INaudio behandelt auch den Klon der eigenen Stimme als digitale Vertonung.

Wo muss der Hinweis im Hörbuch stehen?

Er muss klar und spätestens beim ersten Hören wahrnehmbar sein, nicht versteckt in AGB. Der Praxisleitfaden der Kommission sieht bei reinem Audio einen kurzen gesprochenen Hinweis am Anfang vor. Bei erkennbar fiktionalen Werken ist eine dezentere Form möglich, etwa in Beschreibung oder Ansage.

Muss ich alte KI-Hörbücher nachträglich kennzeichnen?

Nach den Leitlinien nicht: Deepfakes, die vor dem 2. August 2026 erzeugt wurden, müssen nicht rückwirkend gekennzeichnet werden. Die Kommission empfiehlt es aber, wenn es ohne großen Aufwand geht. Die Regeln der Plattformen gelten unabhängig davon.

Nimmt Audible Hörbücher mit KI-Stimme an?

Über den eigenen Upload bei ACX grundsätzlich nicht: Nicht autorisierte KI- und TTS-Aufnahmen sind dort untersagt. KI-Stimmen gibt es bei Audible über Amazons eigenes Programm KDP Virtual Voice, das derzeit kein Deutsch unterstützt, und über eine Voice-Replica-Beta für Sprecherinnen und Sprecher in den USA.