KI-SicherheitModelle 🇺🇸 15.08.2026 01:02

Wie Claudes Text-Wasserzeichen funktioniert

AnthropicAnthropic
Anthropic erklärt die technischen Details der Text-Wasserzeichenfunktion von Claude, die ein unsichtbares Wasserzeichen in KI-generierten Texten einbettet, um deren Herkunft nachvollziehen zu können. Das System funktioniert, indem es während der Generierung subtil die Wortwahl verändert und ein erkennbares Muster erzeugt, ohne die Lesbarkeit zu beeinträchtigen.
Anthropic hat eine technische Erklärung veröffentlicht, wie die Text-Wasserzeichenfunktion von Claude funktioniert. Das Wasserzeichen ist ein unsichtbares Muster, das in den generierten Text eingebettet ist und es Anthropic ermöglicht zu erkennen, ob ein Textstück von Claude erstellt wurde. Es funktioniert, indem während der Generierung subtile, pseudozufällige Entscheidungen zwischen plausiblen Wortalternativen getroffen werden, die durch einen kryptografischen Schlüssel gesteuert werden. Dies erzeugt eine statistische Signatur, die später erkannt werden kann, während sie für Leser unmerklich bleibt. Das System soll dazu beitragen, Missbrauch zu reduzieren, indem es die Rückverfolgbarkeit von KI-generierten Inhalten ermöglicht. Anthropic betont, dass das Wasserzeichen robust ist und die Qualität oder Flüssigkeit des Textes nicht beeinträchtigt.
Quelle: Anthropic (GNews) — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten