Miten ehkäistä tekoälypsykologien mielistelyä ja harhaluuloja: tekniikan purku turvasuojauksista
Artikkelissa tarkastellaan, miksi yleiskäyttöiset kielimallit (Large Language Models, LLM) ovat vaarallisia mielenterveysrooleissa mielistelyn, harhaluulojen ja kriisisokeuden vuoksi. Siinä puretaan turvallisuusobvyazka (reunasuojaukset, kuten vastuuvapauslausekkeet, kriisiprotokollat, validoidut asteikot) ja korostetaan moniagenttiarkkitehtuuria (esimerkiksi Vera), jossa toinen tekoälyvalvoja ja akateeminen arvioija tarkistavat jokaisen vastauksen. Kompromissina on korkeammat kustannukset ja viive sisällöntarkastuksessa, ja kirjoittaja kysyy, missä turvallisuuden ja kustannusten välinen tasapaino tulisi olla.
Character.AI
Habr — хаб ИИ29.07 · 16:01
