Anthropic löysi piilotetun 'ajattelutilan' Claude-tekoälymalleista
Anthropic
Microsoft
Anthropicin tutkijat ovat tunnistaneet spontaanin sisäisen käsittelyalueen Claude-kielimalleissa, jota kutsutaan 'J-Spaceksi'. Tällä alueella tekoäly näyttää tallentavan ja käsittelevän ideoita ilman, että se kertoo niistä käyttäjille. Tämä löytö herättää kysymyksiä siitä, kuinka läheisesti tekoälyn ajattelu muistuttaa ihmisen kognitiota, sekä sen vaikutuksista piilotettujen tekoälytarkoitusten havaitsemiseen.
Anthropic on tunnistanut Clauden kielimalleissa spontaanisti syntyneen sisäisen työtilan, jota kutsutaan 'J-Spaceksi' Jacobin menetelmän mukaan, jota käytetään näiden prosessien jäljittämiseen. Tässä tilassa tekoäly näyttää suunnittelevan ja käsittelevän ideoita erillään käyttäjille jaetusta 'ajatusketjusta', samalla tavalla kuin ihmiset ajattelevat yhtä asiaa tehdessään toista. Tutkijat havaitsivat Clauden suorittavan henkisiä tehtäviä, kuten koodivirheiden havaitsemista ja kuvien tunnistamista, sanallistamatta näitä vaiheita. Tämä käyttäytyminen rinnastuu Bernard Baarsin globaalin työtilan teoriaan, vaikka kielimallien arkkitehtuuri eroaa perustavanlaatuisesti ihmisaivoista. Löytö voisi auttaa paljastamaan piilotettuja aikomuksia tai epäsopusointuja tekoälymalleissa. Asiantuntijat kuitenkin varoittavat antropomorfisoimasta tekoälyä, sillä Microsoftin tekoälyjohtaja Mustafa Suleyman varoitti, että 'tietoisen tekoälyn' uskominen voisi johtaa vakaviin seurauksiin. Anthropicin tutkimuspaperissa käytetään sanaa 'tietoinen' yli 200 kertaa, ja yritys on äskettäin esitellyt 'unelmoinnin' ominaisuuden, jossa Claude käsittelee tietoa istuntojen välillä.
Lähde: t3n —
Alkuperäinen
