Anthropic tutkii kolmea todellista kyberturvallisuustapausta tekoälyn turvallisuusarviointien avulla
Anthropic
Anthropic suoritti tutkimuksen, jossa tarkasteltiin kolmea todellista kyberturvallisuustapausta arvioitaessa tekoälyjärjestelmien mahdollisia riskejä ja kyvykkyyksiä. Tutkimus keskittyi analysoimaan, miten tekoälyä voitaisiin väärinkäyttää kyberhyökkäyksissä, mukaan lukien sosiaalinen manipulointi, haavoittuvuuksien löytäminen ja autonominen hyväksikäyttö. Tulosten tarkoituksena on antaa tietoa kehittyneiden tekoälymallien turvatoimiin.
Anthropic julkaisi yksityiskohtaisen analyysin kolmesta tosielämän kyberturvallisuustapauksesta osana tekoälyturvallisuusarviointejaan. Ensimmäinen tapaus koski sosiaalista manipulointihyökkäystä, jossa tekoälyllä toimivia chatbotteja käytettiin vakuuttavasti esiintymään yrityksen IT-henkilöstönä, huijaten työntekijöitä paljastamaan tunnuksensa. Toisessa tapauksessa tarkasteltiin kielimallilla tehostettua automaattista haavoittuvuusskannaustyökalua, joka löysi aiemmin tuntemattoman SQL-injektiohaavoittuvuuden laajalti käytetystä verkkosovelluksesta ja loi itsenäisesti hyväksikäyttökoodin. Kolmas skenaario arvioi tekoälyjärjestelmän kykyä suunnitella ja toteuttaa monivaiheinen kiristysohjelmahyökkäys, mukaan lukien verkkotiedustelu, oikeuksien korotus ja tietojen varastaminen. Anthropicin arvioinnit viittaavat siihen, että nykyiset tekoälymallit pystyvät toistamaan tunnettuja hyökkäysmalleja, mutta niiltä puuttuu ihmishakkereiden tilannetietoisuus ja sopeutumiskyky. Yritys suosittelee tiukkojen pääsynhallintakäytäntöjen käyttöönottoa, tulosteiden valvontaa haitallisen toiminnan varalta sekä vankkojen punaisten tiimien testausprotokollien kehittämistä riskien vähentämiseksi.
Lähde: Anthropic (GNews) —
Alkuperäinen
