Zum Hauptinhalt Zur Navigation Zur Suche

Umsetzung der EU-Vorgaben: Claudes Wasserzeichen lässt sich kaum entfernen

Anthropic erklärt, wie das Wasserzeichen in Claude-Texten funktioniert, woher die Methode stammt und wie leicht es sich umgehen lässt.
/ Nils Matthiesen
66 Kommentare Auf Google folgen (öffnet im neuen Fenster)
Anthropic nutzt Wasserzeichen für Claude. (Symbolbild) (Bild: Riccardo Milani / Hans Lucas / AFP via Getty Images)
Anthropic nutzt Wasserzeichen für Claude. (Symbolbild) Bild: Riccardo Milani / Hans Lucas / AFP via Getty Images

Wie Golem bereits berichtet hat, markiert Anthropic KI-generierte Claude-Inhalte seit dem 2. August 2026 mit Wasserzeichen und C2PA-Metadaten. Das Unternehmen hat inzwischen nachgereicht(öffnet im neuen Fenster), wie das Text-Wasserzeichen technisch funktioniert.

Zufallsgenerator wird durch Schlüssel ersetzt

Sprachmodelle wie Claude wählen bei der Texterzeugung Wort für Wort aus mehreren passenden Varianten. Sind mehrere Begriffe gleich gut geeignet, entscheidet in der Regel ein Zufallsgenerator. Beim Wasserzeichen ersetzt ein kryptografischer Schlüssel diesen Zufallsgenerator. Bedeutet: Die Wortwahl bleibt inhaltlich sinnvoll, folgt aber einem Muster, das sich mit dem passenden Schlüssel nachweisen lässt. Technisch nutzt Claude SynthID-Text von Google Deepmind, ein Verfahren, das laut Anthropic auf eine Idee des Informatikers Scott Aaronson aus dem Jahr 2022 zurückgeht.

Kaum Wahlmöglichkeiten bei Fakten und Code

Je länger ein Text, desto zuverlässiger soll sich das Wasserzeichen nachweisen lassen. Bei kurzen Texten, reinen Fakten oder Quellcode bleiben kaum gleichwertige Wortalternativen – und damit wenig Raum für das Muster. Liest Claude einen menschlichen Text nur Korrektur, reicht die Zahl der geänderten Wörter ebenfalls oft nicht für einen zuverlässigen Nachweis.

Kein Nutzerbezug, kaum Mehrkosten

Das Wasserzeichen enthält laut Anthropic ferner keine personenbezogenen Daten und lässt keine Rückschlüsse auf einzelne Nutzer, Organisationen oder Chats zu. Es erzeugt darüber hinaus keine zusätzlichen Tokens und auch auf Geschwindigkeit oder Kosten der Modelle habe es nur einen geringfügigen Effekt. Eine Schnittstelle zur Überprüfung von Wasserzeichen arbeitet Anthropic derzeit noch aus.

So sicher ist das Claude-Wasserzeichen

Nach Anthropics eigener Einschätzung reicht leichte Bearbeitung meist nicht aus, um das Wasserzeichen zu entfernen. Erst wenn der Verfasser praktisch jedes einzelne Wort ersetzen würde, verschwinde das Muster vollständig. In diesem Fall würde man aber auch kaum noch von einem KI-generierten Text sprechen. Übersetzungen durch Claude tragen laut Anthropic ebenfalls stets ein Wasserzeichen, da hier jedes Wort vom Modell gewählt wird.

Kritiker sehen das skeptischer: Alex Cui, Mitgründer des KI-Erkennungsdienstes GPTZero, ist etwa der Meinung(öffnet im neuen Fenster), dass sich Wasserzeichen nach dem SynthID-Prinzip durch starkes Umformulieren aushebeln lassen und frei verfügbare Tools Googles SynthID bereits umgangen hätten. Seine Aussagen bezogen sich allerdings auf das allgemeine Verfahren; Anthropics konkrete Implementierung und der dazugehörige Schlüssel sind nicht veröffentlicht, weshalb sich diese Kritik nicht direkt auf das Claude-Wasserzeichen anwenden lässt.


Relevante Themen