Zurück zum Glossar

Begriff

KI-Wasserzeichen (AI Watermarking)

Verfahren, mit dem KI-Anbieter erzeugte Inhalte maschinell erkennbar markieren. Bei Text geschieht das durch ein unsichtbares statistisches Muster in der Wortwahl, bei Dateien durch signierte Herkunfts-Metadaten. Ziel ist der Nachweis, dass ein Modell an einem Inhalt beteiligt war.

KI-Wasserzeichen — ausführlicher erklärt

Ein KI-Wasserzeichen ist eine Markierung, die ein Anbieter in die Ausgabe seines Modells einbettet, damit später maschinell geprüft werden kann, ob ein Inhalt von dieser KI stammt. Anders als ein sichtbarer Hinweis („erstellt mit KI”) ist die Markierung für Leserinnen und Leser unsichtbar und überlebt normales Kopieren.

In der Praxis existieren zwei Familien von Verfahren, die sich technisch stark unterscheiden:

1. Statistisches Text-Wasserzeichen. Ein Sprachmodell hat bei jedem Wort mehrere fast gleichwertige Fortsetzungen zur Auswahl. Beim Wasserzeichnen wird diese Auswahl nicht neutral, sondern nach einem geheimen Schlüssel leicht verzerrt getroffen. Ein einzelnes Wort verrät nichts — über einen ausreichend langen Text entsteht daraus jedoch ein statistisches Muster, das ein Detektor mit dem Schlüssel wiedererkennt. Der bekannteste veröffentlichte Ansatz dieser Art ist SynthID-Text von Google DeepMind (2024); Anthropics Umsetzung ist damit verwandt.

2. Signierte Herkunfts-Metadaten (Content Provenance). Hier wird der Inhalt selbst nicht verändert. Stattdessen hängt an der erzeugten Datei ein kryptografisch signierter Datensatz, der festhält, welches Modell sie erzeugt hat. Der Industriestandard dafür ist C2PA / Content Credentials. Vorteil: eindeutig prüfbar. Nachteil: Metadaten gehen beim Kopieren, Konvertieren oder Screenshotten verloren.

Anthropic setzt beide Verfahren ein. Die Text-Markierung greift bei Modellen, die ab dem 2. August 2026 erschienen sind — zum Start sind das Claude Fable 5.1 und Claude Mythos 5.1. Ältere Modelle wie Claude Opus 5 oder Sonnet 5 sind nicht rückwirkend markiert.

Beispiel / Praxisbezug

Eine Redaktion lässt einen Fachartikel mit Claude Fable 5.1 entwerfen und veröffentlicht ihn nach menschlicher Überarbeitung. Der Rohentwurf trug ein Wasserzeichen; nach starker Umformulierung ist das Signal je nach Eingriffstiefe abgeschwächt oder verschwunden. Ein zweites Team lässt sich von demselben Modell eine Code-Bibliothek schreiben — der eigentliche Code ist weitgehend unmarkiert, die Docstrings und die Dokumentation dagegen sind Fließtext und können das Muster tragen.

Prüfen kann das Wasserzeichen derzeit nicht jeder: Die Detektion läuft über eine Schnittstelle des Anbieters, die zunächst in einer Private Preview für ausgewählte Organisationen verfügbar ist. Für Website-Betreiber heißt das praktisch: Man kann fremde Texte nicht selbst gegenprüfen, muss aber davon ausgehen, dass Plattformen und Prüfstellen es künftig können.

Abgrenzung zu ähnlichen Begriffen

KI-Detektoren (etwa Tools, die „KI-Wahrscheinlichkeit” schätzen) raten anhand von Stilmerkmalen und haben hohe Fehlerquoten — ein Wasserzeichen dagegen prüft ein eingebettetes Signal mit bekanntem Schlüssel. Sichtbare Kennzeichnung im Sinne des EU AI Act ist eine rechtliche Offenlegungspflicht gegenüber Menschen, das Wasserzeichen dagegen eine maschinenlesbare Markierung; Artikel 50 der KI-Verordnung verlangt beides in unterschiedlichen Konstellationen. Digitale Signaturen belegen die Unversehrtheit einer Datei, sagen aber nichts über KI-Beteiligung.

Entdecke mehr