Anthropic kertoo yksityiskohtaisesti Clauen vesileimamenetelmästä EU:n tekoälyasetuksen noudattamisen ja käyttäjävastareaktion keskellä
Anthropic
Anthropic on julkaissut blogikirjoituksen, jossa selitetään, miten sen Clauen vesileimaus toimii, tavoitteena vastata käyttäjien huoliin ja noudattaa EU:n tekoälyasetusta. Yritys käyttää SynthID-Text-tekniikkaa ja julkaisee tunnistusrajapinnan, samalla myöntäen, että voimakas muokkaus voi poistaa vesileimat.
Anthropic julkaisi perjantaina blogikirjoituksen, jossa kerrotaan sen Claude-chatbotin tuottaman tekstin vesileimaamisesta. Muutos, joka ilmoitettiin aiemmin tällä viikolla EU:n tekoälyasetuksen läpinäkyvyyssäännöstön noudattamiseksi, herätti keskustelua käyttäjien keskuudessa: jotkut Redditissä kutsuivat sitä salaliitoksi ja toiset X:ssä peruuttivat tilauksensa. Kirjoituksessa selitetään, että Claude luo huomaamattomia kaavoja matalan panoksen sanavalinnoissa, kuten 'pilvessä' ja 'harmaassa', jotka voidaan havaita avaimella. Anthropic aikoo käyttää Google DeepMintin SynthID-Text-menetelmää ja julkaista vesileiman tunnistusrajapinnan. Siinä myös erotetaan vesileimaus tekoälyn tunnistusmenetelmistä, kuten Pangramin menetelmistä, jotka etsivät tyylillisiä 'tunnusmerkkejä'. Yritys myönsi, että täydellinen uudelleenkirjoitus, joka poistaisi jokaisen vesileimasanan, poistaisi vesileiman, mutta kevyt muokkaus ei todennäköisesti poista sitä. Oikoluetussa tai muokatussa tekstissä vesileiman läsnäolo riippuu muokkauksen pituudesta ja laajuudesta. Koodissa vesileimaus on vähäisempää, koska mallin on tuotettava toimivaa koodia, vaikka kommentit voivatkin sisältää vesileimoja. Lopuksi Anthropic huomautti, että muut suuret mallien kehittäjät ovat allekirjoittaneet saman käytännesäännöstön ja ottavat käyttöön omat vesileimansa.
Lähde: TechCrunch AI —
Alkuperäinen
