Anthropic detailleert Claude's watermerkaanpak te midden van naleving van de EU AI-wet en gebruikersterugslag
Anthropic
Anthropic heeft een blogpost gepubliceerd waarin wordt uitgelegd hoe de watermerking voor Claude zal werken, met als doel gebruikerszorgen aan te pakken en te voldoen aan de EU AI-wet. Het bedrijf zal SynthID-Text gebruiken en een detectie-API uitbrengen, terwijl het erkent dat zware bewerking watermerken kan verwijderen.
Anthropic heeft vrijdag een blogpost gepubliceerd waarin het watermerken van door zijn chatbot Claude gegenereerde tekst wordt toegelicht. Deze stap, die eerder deze week werd aangekondigd om te voldoen aan de Transparantiecode van de EU AI-wet, leidde tot discussie onder gebruikers: sommigen op Reddit noemden het een complot, anderen op X zeiden hun abonnement op te zeggen. De post legt uit dat Claude niet-detecteerbare patronen creëert in woordkeuzes met lage inzet, zoals tussen 'bewolkt' en 'grijs', die met een sleutel kunnen worden opgespoord. Anthropic zal gebruikmaken van de SynthID-Text-methode van Google DeepMind en is van plan een API voor watermerkdetectie uit te brengen. Het bedrijf maakt ook onderscheid tussen watermerken en AI-detectiemethoden zoals die van Pangram, die zoeken naar stilistische 'kenmerken'. Het bedrijf gaf toe dat een volledige herschrijving waarbij elk watermerkwoord wordt geëlimineerd het watermerk zou verwijderen, maar lichte bewerkingen waarschijnlijk niet. Bij proefgelezen of bewerkte tekst hangt de aanwezigheid van het watermerk af van de lengte en de mate van bewerking. Code zal minder watermerken bevatten omdat het model functionele code moet produceren, hoewel opmerkingen watermerken kunnen bevatten. Tot slot merkte Anthropic op dat andere grote modelontwikkelaars dezelfde Gedragscode hebben ondertekend en hun eigen watermerken zullen implementeren.
Bron: TechCrunch AI —
origineel
