Umsetzung der EU-Vorgaben: Claudes Wasserzeichen lässt sich kaum entfernen
Wie Golem bereits berichtet hat, markiert Anthropic KI-generierte Claude-Inhalte seit dem 2. August 2026 mit Wasserzeichen und C2PA-Metadaten. Das Unternehmen hat inzwischen nachgereicht(öffnet im neuen Fenster), wie das Text-Wasserzeichen technisch funktioniert.
Zufallsgenerator wird durch Schlüssel ersetzt
Sprachmodelle wie Claude wählen bei der Texterzeugung Wort für Wort aus mehreren passenden Varianten. Sind mehrere Begriffe gleich gut geeignet, entscheidet in der Regel ein Zufallsgenerator. Beim Wasserzeichen ersetzt ein kryptografischer Schlüssel diesen Zufallsgenerator. Bedeutet: Die Wortwahl bleibt inhaltlich sinnvoll, folgt aber einem Muster, das sich mit dem passenden Schlüssel nachweisen lässt. Technisch nutzt Claude SynthID-Text von Google Deepmind, ein Verfahren, das laut Anthropic auf eine Idee des Informatikers Scott Aaronson aus dem Jahr 2022 zurückgeht.
Kaum Wahlmöglichkeiten bei Fakten und Code
Je länger ein Text, desto zuverlässiger soll sich das Wasserzeichen nachweisen lassen. Bei kurzen Texten, reinen Fakten oder Quellcode bleiben kaum gleichwertige Wortalternativen – und damit wenig Raum für das Muster. Liest Claude einen menschlichen Text nur Korrektur, reicht die Zahl der geänderten Wörter ebenfalls oft nicht für einen zuverlässigen Nachweis.
Kein Nutzerbezug, kaum Mehrkosten
Das Wasserzeichen enthält laut Anthropic ferner keine personenbezogenen Daten und lässt keine Rückschlüsse auf einzelne Nutzer, Organisationen oder Chats zu. Es erzeugt darüber hinaus keine zusätzlichen Tokens und auch auf Geschwindigkeit oder Kosten der Modelle habe es nur einen geringfügigen Effekt. Eine Schnittstelle zur Überprüfung von Wasserzeichen arbeitet Anthropic derzeit noch aus.
So sicher ist das Claude-Wasserzeichen
Nach Anthropics eigener Einschätzung reicht leichte Bearbeitung meist nicht aus, um das Wasserzeichen zu entfernen. Erst wenn der Verfasser praktisch jedes einzelne Wort ersetzen würde, verschwinde das Muster vollständig. In diesem Fall würde man aber auch kaum noch von einem KI-generierten Text sprechen. Übersetzungen durch Claude tragen laut Anthropic ebenfalls stets ein Wasserzeichen, da hier jedes Wort vom Modell gewählt wird.
Kritiker sehen das skeptischer: Alex Cui, Mitgründer des KI-Erkennungsdienstes GPTZero, ist etwa der Meinung(öffnet im neuen Fenster), dass sich Wasserzeichen nach dem SynthID-Prinzip durch starkes Umformulieren aushebeln lassen und frei verfügbare Tools Googles SynthID bereits umgangen hätten. Seine Aussagen bezogen sich allerdings auf das allgemeine Verfahren; Anthropics konkrete Implementierung und der dazugehörige Schlüssel sind nicht veröffentlicht, weshalb sich diese Kritik nicht direkt auf das Claude-Wasserzeichen anwenden lässt.
- Anzeige Hier geht es zu Künstliche Intelligenz: Wissensverarbeitung bei Amazon Wenn Sie auf diesen Link klicken und darüber einkaufen, erhält Golem eine kleine Provision. Dies ändert nichts am Preis der Artikel.


