Beide Fassungen sind Block für Block ausgerichtet, in der Reihenfolge des Textes: Titel, das Wesentliche, dann Absatz für Absatz. Wo die Übersetzung einen Absatz zusammengezogen oder geteilt hat, bleibt das entsprechende Feld leer — wir stellen niemals zwei Passagen nach Gefühl nebeneinander.
Anthropic published a blog post on Friday explaining how it will watermark Claude's generated text, a practice it had announced earlier in the week to conform with the EU AI Act's Transparency Code. The post answers questions that have stirred debate since the announcement, including whether the mark can be hidden by editing and how it applies to code.
Anthropic hat am Freitag einen Blogbeitrag veröffentlicht, in dem das Unternehmen erklärt, wie es von Claude erzeugte Texte mit einem Wasserzeichen versehen will. Die Maßnahme war zu Beginn der Woche angekündigt worden, um den Transparenzkodex des EU AI Act einzuhalten. Der Beitrag beantwortet Fragen, die seit der Ankündigung für Diskussionen sorgen – unter anderem, ob sich die Markierung durch Bearbeitungen verbergen lässt und wie sie auf Code angewendet wird.
The company said it will use the SynthID-Text approach that Google DeepMind outlined in 2024. When Claude makes "low-stakes choices" — such as using "overcast" rather than "grey" to describe the weather — the model can build a pattern "undetectable to the reader, but is detectable to anyone who has a key that encodes it". Anthropic also said it plans to release a watermark detection API.
Das Unternehmen erklärte, den Ansatz SynthID-Text zu verwenden, den Google DeepMind 2024 vorgestellt hat. Wenn Claude „nebensächliche Entscheidungen“ trifft – etwa „overcast“ statt „grey“ zur Beschreibung des Wetters verwendet –, kann das Modell ein Muster erzeugen, das „für den Leser nicht erkennbar, aber für jeden erkennbar ist, der einen Schlüssel besitzt, der es codiert“. Anthropic erklärte außerdem, eine API zur Erkennung von Wasserzeichen veröffentlichen zu wollen.
Users pushing back in forums and on social media: a Reddit poster saw the watermark as a conspiracy, while another stated that anyone wanting Claude without it wants to "lie to people". According to Business Insider, "dozens" of users on X claimed they have cancelled their Claude subscriptions over the change.
Nutzer, die sich in Foren und sozialen Medien gegen die Maßnahme aussprechen, reagierten unterschiedlich: Ein Reddit-Nutzer sah in dem Wasserzeichen eine Verschwörung, während ein anderer erklärte, jeder, der Claude ohne Wasserzeichen nutzen wolle, wolle „Menschen belügen“. Laut Business Insider gaben „Dutzende“ Nutzer auf X an, wegen der Änderung ihre Claude-Abonnements gekündigt zu haben.
Anthropic did address the Waterproof. It said the object would not impact quality: "To a reader, a watermarked response is indistinguishable from an unwatermarked one." Light editing "probably won't remove the watermark completely", while a full word-for-word rewrite will. For text only proofread by Claude, "nearly all the words" remain the human author's, leaving little for a watermark to attach to. The approach also differs from style-based AI detection tools, which look for repeated telltale phrasing like "this isn't [X], it's [Y]".
Anthropic ging auch auf das Wasserzeichen ein. Das Unternehmen erklärte, es werde die Qualität nicht beeinträchtigen: „Für einen Leser ist eine Antwort mit Wasserzeichen nicht von einer Antwort ohne Wasserzeichen zu unterscheiden.“ Leichte Bearbeitungen würden das Wasserzeichen „wahrscheinlich nicht vollständig entfernen“, eine vollständige Neufassung Wort für Wort hingegen schon. Bei Texten, die von Claude lediglich auf Fehler geprüft wurden, blieben „nahezu alle Wörter“ vom menschlichen Autor, sodass das Wasserzeichen nur wenig Ansatzpunkt habe. Der Ansatz unterscheidet sich außerdem von KI-Erkennungstools, die auf dem Schreibstil basieren und nach wiederkehrenden verräterischen Formulierungen wie „Das ist nicht [X], sondern [Y]“ suchen.
Code is a special case. Because the model must produce something that runs, it cannot always choose among equally valid options. Anthropic says in the places with an arbitrary choice such as comments inside the code, the watermark can apply, "but by definition, it will have a negligible effect on the actual code produced".
Code ist ein Sonderfall. Da das Modell etwas erzeugen muss, das ausgeführt werden kann, kann es nicht immer zwischen gleichwertigen Optionen wählen. Anthropic zufolge kann das Wasserzeichen an Stellen mit einer willkürlichen Auswahl – etwa bei Kommentaren innerhalb des Codes – eingesetzt werden, „aber per Definition wird es nur einen vernachlässigbaren Effekt auf den tatsächlich erzeugten Code haben“.
What this changes concretely: for Claude users, it will soon be possible to verify whether a text was AI-generated, without any visual cue in Claude's output. The company does not be alone — "other major developers have signed the same Code of Conduct and will be implementing their own watermarks". But practical boundaries are clear: lightly edited proofread text may carry no watermark, and a rewritten text escapes detection. That sets a reasonable, not absolute, accountability.
Was sich dadurch konkret ändert: Für Claude-Nutzer wird es bald möglich sein zu überprüfen, ob ein Text von einer KI erzeugt wurde – ohne sichtbaren Hinweis in Claudes Ausgabe. Das Unternehmen wird dabei nicht allein sein: „Andere große Entwickler haben denselben Verhaltenskodex unterzeichnet und werden ihre eigenen Wasserzeichen implementieren.“ Die praktischen Grenzen sind jedoch klar: Leicht bearbeitete, von Claude korrigierte Texte können kein Wasserzeichen tragen, und eine neu geschriebene Fassung entzieht sich der Erkennung. Das schafft eine angemessene, aber keine absolute Verantwortlichkeit.