Tutkimus 🇷🇺 24.07.2026 19:02

Global Workspacen löytäminen kielimalleista: Clauden tapaus

AnthropicAnthropic
Anthropicin tutkijat ovat löytäneet kielimalli Claudesta tietyn joukon sisäisiä hermokuvioita – J-avaruuden – joka toimii "työtilana" ajatusten tietoiselle pääsylle. Tätä tilaa ei ohjelmoitu, vaan se syntyi luonnollisesti koulutuksen aikana. J-avaruus antaa mallille mahdollisuuden raportoida sisäisistä representaatioistaan, muokata niitä tarpeen mukaan ja käyttää niitä sisäiseen päättelyyn, mikä muistuttaa neurotieteen globaalin työtilan teoriaa.
Anthropicin artikkelissa esitetään todisteita siitä, että nykyaikaisiin kielimalleihin, erityisesti Claudiin, on muodostunut pieni joukko sisäisiä hermokuvioita, joita kutsutaan J-avaruudeksi. Nämä kuviot havaittiin Jacobin linssi -menetelmällä (J-linssi), joka löytää sisäistä aktiivisuutta, joka lisää tietyn sanan tuottamisen todennäköisyyttä tulevaisuudessa. J-avaruudella on ainutlaatuisia ominaisuuksia: Claude voi raportoida siinä olevista representaatioista, muokata niitä pyynnöstä, käyttää niitä sisäiseen monivaiheiseen päättelyyn sekä soveltaa joustavasti samaa representaatiota eri tehtäviin. Samalla J-avaruus ei osallistu useimpiin automaattisiin prosesseihin, kuten sujuvaan puheeseen tai kielioppiin, ja sen poistaminen käytöstä ei häiritse mallin perustoimintaa, mutta vie siltä korkeamman tason kognitiiviset toiminnot. Kokeet osoittivat, että J-avaruudella on vahvat yhteydet muuhun hermoverkkoon, mikä mahdollistaa sen toimimisen ”globaalina työtilana”, samanlaisena kuin tietoisen pääsyn teoria neurotieteessä. Tutkijat huomauttavat, että nämä löydöt eivät kerro Clauden tietoisuudesta, mutta tarjoavat käytännön työkalun sen sisäisten ajatusten tarkkailuun, kuten petosyritysten tai piilotettujen tavoitteiden havaitsemiseen. Artikkeliin liittyy tieteellinen julkaisu, avoin lähdekoodi ja interaktiivinen demo.
Lähde: Habr — хаб ИИ — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset