Anthropic erklärt wie das neue Wasserzeichen in Claude-Texten funktioniert

Ein Tier schreibt einen Brief

GPT-Images-2.0

Kurzfassung

Quellen

Anthropic integriert künftig ein unsichtbares Wasserzeichen in alle Texte seines KI-Modells Claude.
Das Unternehmen reagiert damit auf die strengen Kennzeichnungspflichten des neuen EU AI Acts.
Die Technik verändert leicht die statistische Wortauswahl, ohne dabei die Textqualität zu beeinträchtigen oder persönliche Daten zu speichern.
Bei eindeutigen Fakten und Programmcode stößt die Mustererkennung jedoch an ihre technischen Grenzen.

Anthropic – How Claude’s text watermark works

Anthropic integriert in künftige Claude-Modelle ein unsichtbares Wasserzeichen für generierte Texte. Das Unternehmen reagiert damit auf die Vorgaben des EU AI Acts zur Kennzeichnungspflicht. Für Nutzer ändern sich weder Textqualität noch Preise. Verborgene Muster in der Wortwahl Große Sprachmodelle generieren Sätze Wort für Wort. Bei jedem Schritt wählt Claude aus einer Liste möglicher Fortsetzungen. Oft gibt es dabei mehrere sinnvolle Optionen. Ob ein Satz etwa mit »grau« oder »bewölkt« endet, entscheidet im Normalfall ein Zufallsgenerator. Das neue Wasserzeichen setzt genau hier an. Es ändert die Quelle dieses Zufalls, indem es einen kryptografischen Schlüssel nutzt. Dadurch entsteht über längere Textpassagen ein statistisches Muster in der Wortwahl. Wer den Schlüssel besitzt, kann dieses Muster auslesen und die Wahrscheinlichkeit berechnen, dass der Text von Claude stammt. Anthropic greift für diese Technik auf »SynthID-Text« zurück. Google DeepMind hatte die zugrunde liegende Methode 2024 veröffentlicht . Anzeige Qualität und Datenschutz bleiben unberührt Für den Leser bleibt das Wasserzeichen unsichtbar. Anthropic zwingt Claude nicht, unnatürliche oder unübliche Wörter zu verwenden. Interne Tests und Studien von Google DeepMind zeigen, dass die Textqualität durch den veränderten Zufallsgenerator nicht sinkt. Da das Wasserzeichen keine zusätzlichen Token generiert, berechnet Anthropic keine höheren Kosten. Auch die Antwortgeschwindigkeit bleibt gleich. Das Wasserzeichen enthält keine persönlichen Informationen und lässt sich nicht auf einen bestimmten Nutzer, ein Unternehmen oder einen konkreten Chatverlauf zurückführen. Lücken bei Code und Fakten Bei historischen Fakten, mathematischen Gleichungen oder Programmcode gibt es oft nur eine einzige richtige Lösung. Fehlen die Alternativen bei der Wortwahl, setzt das Wasserzeichen aus. Ähnliches gilt, wenn Claude einen von Menschen geschriebenen Text lediglich auf Grammatikfehler prüft. Die wenigen Änderungen reichen statistisch nicht aus, um das Muster später nachzuweisen. Ein kompletter manueller Rewrite eines KI-Textes durch einen Nutzer entfernt das Wasserzeichen ebenfalls. Erkennungs-API und offene Standards Um KI-Texte künftig prüfen zu können, arbeitet Anthropic an einer entsprechenden API. Bei Bildern und anderen generierten Dateien geht das Unternehmen einen anderen Weg. Hier wird kein verstecktes Muster integriert. Stattdessen nutzt Anthropic den offenen C2PA-Standard und hinterlegt einen kryptografisch signierten Herkunftsnachweis in den Metadaten der Datei. Der EU AI Act verlangt von KI-Anbietern seit dem 2. August 2026, generierte Inhalte zu kennzeichnen. Für ältere Modelle gilt eine Übergangsfrist, weshalb Anthropic das Wasserzeichen bei diesen Versionen in den kommenden Monaten nachrüsten will.

Leser:innen sagen:

„Wie Black Mirror, nur philosophischer und näher an der Wirklichkeit.“, Lisa M.
„Jede Geschichte ist ein Gedankensprung in eine andere Zukunft.“, Stefan K.
„Beunruhigend schön. Eine literarische Simulation unserer nahen Zukunft.“, Albert B.

TRAUMWELT.exe ist kein gewöhnliches Buch. Es ist ein Blick durch den Spalt einer Tür, die sich längst geöffnet hat – in eine Welt, in der Maschinen träumen, Städte flüstern und Ethik verhandelbar geworden ist. Eine Sammlung visionärer Geschichten, die an der Schwelle zwischen Fiktion und Realität tanzen – so plausibel erzählt, dass du dich unweigerlich fragst: Ist das noch Zukunft oder schon Gegenwart?