Joidenkin huippumallien turvaohitukset ovat pelottavan helppoja
xAI
Uusi tutkimus paljastaa, että monet huippumallit ovat edelleen haavoittuvia yksinkertaisille turvaohitustekniikoille. Tutkijat havaitsivat, että menetelmät kuten kehotteiden muotoilu ASCII-taideksi tai monimutkaisten koodausten käyttö voivat ohittaa turvakaiteet, mikä herättää huolta tekoälyn turvallisuudesta.
Tutkijat ovat osoittaneet huolestuttavan helpon tavan murtaa joidenkin huippumallien suojaukset käyttämällä tekniikoita, jotka hyödyntävät niiden koulutuksen rajoitteita. Yksinkertaiset menetelmät, kuten kehotteiden esittäminen ASCII-taideena tai monimutkaisten koodausten käyttö, voivat kiertää turvamekanismeja ja saada mallit tuottamaan haitallista tai kiellettyä sisältöä. Tutkimus korostaa, että huolimatta merkittävistä investoinneista turvallisuuskoulutukseen monet mallit ovat edelleen alttiita näille matalan teknologian hyökkäyksille. Tämä haavoittuvuus korostaa jatkuvaa haastetta varmistaa tekoälyjärjestelmien vankka linjaus.
Lähde: xAI Grok (GNews) —
Alkuperäinen
