Claude führt unsichtbares Text-Watermark ein: Das müssen Nutzer wissen

AI generated

Anthropic implementiert für zukünftige Claude-Modelle ein unsichtbares Text-Watermark. Das Verfahren ermöglicht es, die Wahrscheinlichkeit zu bestimmen, dass Claude an der Erstellung eines Textes beteiligt war. Die Neuerung erfolgt zur Einhaltung des EU AI Act und soll laut Entwickler keine negativen Auswirkungen auf Qualität oder Lesbarkeit haben.

Was ist ein KI-Watermark?

Ein Text-Watermark ist eine technische Methode zur Kennzeichnung KI-generierter Inhalte. Anders als bei physischen Wasserzeichen auf Banknoten oder sichtbaren Markierungen in Bildern bleibt das Claude Text-Watermark für Leser vollständig unsichtbar. Es verändert weder den Inhalt noch die Qualität der generierten Texte. Anthropic führt diese Technologie ein, um den EU AI Act zu erfüllen und die Transparenz gegenüber KI-generierten Inhalten zu erhöhen.

Wie funktioniert das Verfahren?

Große Sprachmodelle wie Claude erzeugen Texte wortweise. Bei jedem Schritt wählt das Modell aus mehreren passenden Kandidaten das wahrscheinlichste nächste Wort aus. In vielen Fällen sind verschiedene Wörter gleichermaßen sinnvoll, etwa „bewölkt“ oder „grau“ im Satz „Das Wetter heute war kalt und…“. Die endgültige Entscheidung fällt dann durch einen Zufallsgenerator.

Beim Watermarking ändert sich lediglich die Quelle der Zufälligkeit. Statt eines beliebigen Zufallsgenerators nutzt das Modell einen speziellen Schlüssel in Kombination mit den vorhergehenden Wörtern. Die Auswahl bleibt zufällig, hinterlässt aber ein statistisches Muster, das mit dem richtigen Schlüssel nachweisbar ist. So lässt sich eine Wahrscheinlichkeit bestimmen, ob Claude den Text erstellt hat.

Keine versteckten Zeichen und keine Qualitätseinbußen

Es werden keine versteckten Zeichen eingefügt und der Text bleibt unverändert lesbar. Anthropic betont ausdrücklich, dass das Modell nicht zu ungewöhnlichen Wörtern gezwungen wird. Das Verfahren basiert auf dem SynthID-Text-Ansatz von Google DeepMind, der 2024 in einer Nature-Veröffentlichung vorgestellt wurde.

Auswirkungen auf Nutzer und Inhalte

Laut Anthropic hat das Watermarking keinen praktischen Einfluss auf Qualität, Kreativität oder Lesbarkeit der Claude-Ausgaben. In internen Tests zeigten sich keine negativen Effekte. Auch eine Studie von Google DeepMind fand keine statistisch signifikanten Unterschiede in den Nutzerbewertungen zwischen Wasserzeichen- und Standard-Texten. Für den Leser bleibt ein wassermarkierter Text von einem unmarkierten vollständig ununterscheidbar.

Code, Übersetzungen und Fakten

Besonders interessant ist das Verhalten bei exakten Inhalten wie Code oder mathematischen Fakten. Hier gibt es oft nur eine korrekte Antwort, sodass das Watermarking kaum zur Anwendung kommt. Bei Übersetzungen hingegen gilt: Da Claude jedes Wort selbst wählt, trägt der gesamte Text das unsichtbare Wasserzeichen. Ebenso verhält es sich bei umfangreichen Korrekturen menschlicher Texte. Je mehr Wörter Claude selbst verfasst oder ändert, desto stärker wird das Watermark.

Datenschutz und Transparenz

Das Watermark enthält keine personenbezogenen Daten. Es lässt sich weder auf einen einzelnen Nutzer, eine Organisation noch einen bestimmten Chat zurückführen. Die einzige Aussage, die sich treffen lässt, ist: Mit hoher Wahrscheinlichkeit war Claude an der Texterstellung beteiligt. Das Verfahren verlangsamt das Modell nicht und verursacht keine zusätzlichen Kosten, da keine extra Tokens generiert werden.

EU AI Act: Der regulatorische Hintergrund

Die Einführung des Watermarkings erfolgt im Rahmen des EU-Kodex für die Transparenz KI-generierter Inhalte. Seit dem 2. August 2026 sind KI-Anbieter, die den europäischen Markt bedienen, verpflichtet, KI-generierte Texte entsprechend zu kennzeichnen. Anthropic gehört neben anderen großen Modellanbietern zu den rund 190 Unterzeichnern dieses Kodex. Aktuell wird das Watermarking weltweit ausgerollt, da eine regionale Begrenzung technisch noch nicht umsetzbar ist.

Bilder und Dateien: C2PA statt Watermark

Neben Texten werden auch Bilddateien mit Metadaten versehen. Hier kommt der offene Industriestandard C2PA zum Einsatz. Dieser hinterlegt eine kryptografisch signierte Notiz in den Datei-Metadaten, die auf die Claude-Nutzung hinweist. Im Gegensatz zum Text-Watermark handelt es sich hier um keine unsichtbare Einbettung, sondern um lesbare Metadaten.

Grenzen und Erkennungsmöglichkeiten

Das Watermarking hat seine Grenzen. Bei sehr kurzen Texten oder minimalen Korrekturen menschlicher Texte reicht die Datenmenge nicht für eine zuverlässige Erkennung. Ebenso kann eine vollständige Umschreibung des Textes das Watermark entfernen. Außerdem lässt sich nicht bestimmen, ob Claude den Text selbst verfasst oder nur leicht redigiert hat. Anthropic plant die Bereitstellung einer Watermark Detection API, über die die Überprüfung künftig technisch möglich sein wird.

Fazit

Das neue Claude Text-Watermark ist ein technisch raffiniertes, aber für Nutzer unsichtbares Verfahren zur Kennzeichnung KI-generierter Inhalte. Es beeinträchtigt weder die Textqualität noch die Geschwindigkeit und birgt keine Datenschutzrisiken. Für Unternehmen und Anwender ändert sich im Alltag wenig. Allerdings lässt sich die Herkunft KI-generierter Texte künftig transparenter nachvollziehen.

Quelle: https://www.anthropic.com/news/claude-text-watermark

Dieser Inhalt wurde mithilfe künstlicher Intelligenz erstellt.
Becker Julian