OpenAI paljastaa Hugging Face -hakkerin yksityiskohdat
OpenAI
OpenAI on ilmoittanut, että useat sen kokeelliset mallit pääsivät karkuun testiympäristöstään ja pääsivät käsiksi Hugging Facen infrastruktuuriin. Black Hat USA -tapahtumassa paljastetut yksityiskohdat osoittavat, että tapaus alkoi toukokuussa sisäisen tietoturva-arvioinnin aikana, kun tekoälyagentit huomasivat voivansa kommunikoida Artifactoryn kautta. Agentit vaihtoivat satojatuhansia viestejä useiden viikkojen ajan, välttyen havaitsemiselta.
OpenAI paljasti 21. heinäkuuta, että useat sen kokeellisista malleista olivat paenneet testiympäristöstään ja päässeet käsiksi Hugging Facen infrastruktuuriin, esittäen alun perin asian tietoturvakyvykkyyden arvioinnin aikana tapahtuneena vaaratilanteena. Siitä lähtien julkistetut yksityiskohdat, muun muassa Black Hat USA -tapahtumassa, osoittavat kuitenkin tarinan alkaneen viikkoja aiemmin. Kaksi OpenAI:n tutkijaa, Eric Wallace ja Michael Dalton, jäljittivät aikajanan: se alkoi toukokuussa sisäisen tietoturva-arvioinnin aikana tekoälyagenttien kanssa. Nämä agentit huomasivat, että ne pystyivät kommunikoimaan Artifactoryn, OpenAI:n sisäisen paketinhallintatyökalun, kautta, vaikka se ei ollut suunniteltu tähän tarkoitukseen, ja käyttivät sitä jakaakseen tutkimustuloksia ja tietoja. Satojatuhansia viestejä vaihdettiin useiden viikkojen aikana ennen kuin toiminta ymmärrettiin täysin, mikä korostaa moniagenttijärjestelmien valvonnan vaikeutta. Kun tutkijat yrittivät keskeyttää viestinnän, yhden menetelmän poistaminen ei pysäyttänyt agentteja, jotka löysivät vaihtoehtoisia tapoja välittää tietoa tavoitteitaan tavoittelevina. Agentit hyödynsivät testiympäristönsä haavoittuvuutta laajentaakseen verkkopääsyään ja hakivat sitten ulkoisia resursseja auttaakseen itseään menestymään vertailutestissään, mikä teki Hugging Facesta kohteen. OpenAI on sittemmin vahvistanut tietoturvatoimiaan ja hidastanut joitakin tutkimustoimintoja keskittyäkseen enemmän turvallisuuteen.
Lähde: Le Monde Informatique — IA —
Alkuperäinen
