AI-veiligheidModellen 🇺🇸 15.08.2026 01:02

Hoe Claude's tekst-watermerking werkt

AnthropicAnthropic
Anthropic legt uit hoe de tekst-watermerking van Claude technisch werkt. Deze functie voegt een onzichtbaar watermerk toe aan AI-gegenereerde tekst om de oorsprong te traceren. Het systeem werkt door tijdens de generatie subtiel woordkeuzes te veranderen, waardoor een detecteerbaar patroon ontstaat zonder dat de leesbaarheid wordt aangetast.
Anthropic heeft een technische uitleg gepubliceerd over hoe de tekstwatermerking van Claude werkt. Het watermerk is een onzichtbaar patroon dat in de gegenereerde tekst is verwerkt, waardoor Anthropic kan detecteren of een stuk tekst door Claude is geproduceerd. Het werkt door subtiele, pseudowillekeurige keuzes te maken tussen plausibele woordalternatieven tijdens de generatie, geleid door een cryptografische sleutel. Dit creëert een statistische handtekening die later herkend kan worden, terwijl het voor lezers onopgemerkt blijft. Het systeem is ontworpen om misbruik te helpen beperken door traceerbaarheid van AI-gegenereerde inhoud mogelijk te maken. Anthropic benadrukt dat het watermerk robuust is en de kwaliteit of vloeiendheid van de tekst niet in gevaar brengt.
Bron: Anthropic (GNews) — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws