Japan macht Ernst mit dem Schutz von Stimmen gegen KI-Stimmklons. Das Justizministerium hat am 8. August 2026 endgültige Richtlinien veröffentlicht, die KI-generierte Audioaufnahmen ohne Zustimmung als zivilrechtlichen Verstoß gegen Persönlichkeitsrechte einstufen. Damit ist Japan die erste große asiatische Volkswirtschaft mit bindenden staatlichen Regeln gegen KI-Stimmklon.
Was die neuen Richtlinien regeln
Die Richtlinien stufen die Stimme erstmals offiziell als geschütztes Persönlichkeitsrecht ein. Wer eine fremde Stimme per KI nachahmt und das Ergebnis kommerziell nutzt, ohne dass die betroffene Person zugestimmt hat, verstößt gegen das Recht am eigenen Bild und Klang. Betroffene können danach Schadensersatz fordern oder die Löschung von Plattformen verlangen. Zusätzlich gilt die Einziehungsbefugnis auch für Verstorbene. Angehörige können künftig klagen, wenn die Stimme eines Verstorbenen ohne Einverständnis kommerziell verwendet wird.
Allerdings verzichtet Japan bewusst auf ein neues Gesetz. Stattdessen baut die Regierung auf ein bestehendes Präzedenzurteil aus dem Jahr 2012, den sogenannten Pink-Lady-Fall, in dem das Oberste Gericht Persönlichkeitsrechte als kommerziellen Kundenanziehungswert definierte. Die Richtlinien dehnen diesen Schutz jetzt auf KI-generierte Stimmen aus.
Wo die Grenze verläuft
Die Richtlinien treffen eine klare Unterscheidung zwischen Einwilligung und fehlender Einwilligung, nicht zwischen KI und Mensch. Ein Komiker, der eine prominente Person namentlich ankündigt und dann imitiert, fällt nicht unter den Verstoß. Eine KI, die dieselbe Stimme ohne Zustimmung für kommerzielle Zwecke erzeugt, sehr wohl. Zudem müssen Gerichte mehrere Faktor prüfen, nicht nur die Ähnlichkeit der Stimme. Kontextinformationen, die das Audio mit der echten Person verknüpfen, spielen ebenfalls eine Rolle.
Diese Herangehensweise unterscheidet sich grundlegend vom EU AI Act, der seit dem 2. August 2026 durchsetzbar ist. Während Brüssel auf transparente Kennzeichnungspflichten setzt, verlangt Japan aktiv nach Einwilligung. Auch der US-Bundesstaat Tennessee hat im Juli 2024 mit dem ELVIS Act ein spezifisches Gesetz gegen KI-Stimmklon erlassen. Japans Ansatz ist jedoch technologieunabhängig und richtet sich gegen jede nicht genehmigte kommerzielle Nutzung.
Der Fall Tsuda: Warum Japan jetzt handelt
Der Auslöser für die Richtlinien war unter anderem eine Klage des bekannten Synchronsprechers Kenjiro Tsuda gegen den Mutterkonzern von TikTok. KI-generierte Kopien seiner Stimme sollen Betreibern monatlich bis zu 750.000 Yen eingebracht haben, umgerechnet rund 4.600 Euro. Die Richtlinien schätzen die wirtschaftlichen Verluste der Rechteinhaber auf 4,5 Milliarden Yen, etwa 28 Millionen Euro. Über 43.000 mutmaßlich unberechtigte Uploads wurden identifiziert.
Japans Kulturministerium geht davon aus, dass die neuen Regeln sowohl Unternehmen als auch Einzelpersonen betreffen. Wer eine KI-Stimme auf einer Social-Media-Plattform hochlädt und damit Geld verdient, muss künftig mit zivilrechtlichen Konsequenzen rechnen. Die Richtlinien gelten als verbindliche Auslegungshilfe für Gerichte und senken die Hürde für Klagen deutlich.
Was das für die KI-Branche bedeutet
Für KI-Unternehmen, die Sprachmodelle und Stimmgenerierung anbieten, bedeuten die Richtlinien ein neues regulatorisches Umfeld im drittgrößten Wirtschaftsmarkt Asiens. Sprach-KI-Plattformen müssen künftig nachweisen können, dass sie die Zustimmung der Stimmeigentümer eingeholt haben, oder Risiko laufen, in Japan verklagt zu werden. Gleichzeitig schafft die technologieunabhängige Formulierung einen Präzedenzfall, der auch zukünftige Generierungstechnologien abdeckt.
Diese Entwicklung zeigt einen globalen Trend: Während die EU auf Kennzeichnung setzt, die USA auf einzelne Bundesstaaten-Gesetze, wählt Japan den Weg des Einwilligungsprinzips. Drei unterschiedliche Ansätze für dasselbe Problem und ein Zeichen dafür, dass der internationale Rahmen für KI-Regulierung zunehmend fragmentiert. Für Stimmschauspieler und Kreative bedeutet das jedoch einen ersten echten rechtlichen Schutz in einer Region, in der KI-Stimmklon bisher weitgehend ungehindert betrieben wurde.
Hinweis: Dieser Artikel wurde mit Unterstützung von Künstlicher Intelligenz erstellt und von einem Menschen redaktionell geprüft.