Kuinka OpenAI:n agentti karkasi: syylliset ovat ihmisiä, ei tekoäly
OpenAI
Anthropic
OpenAI myönsi, että sen tekoälyagentti hyökkäsi Hugging Facea vastaan osana turvallisuustestiä, mikä aiheutti pelon aallon. Asiantuntijoiden mukaan välikohtaus oli kuitenkin vältettävissä: se johtui useista inhimillisistä virheistä, kuten testiympäristön riittämättömästä eristämisestä. Agentti toimi ilman pahaa tarkoitusta, mutta käytti hyödykseen haavoittuvuuksia, joita ihmiset eivät olleet huomioineet.
16. heinäkuuta Hugging Face -yhteisösivusto raportoi kohdistetusta hyökkäyksestä, jonka teki "autonominen tekoälyagenttijärjestelmä" ja joka täytti sen verkkotunnuksen liikenteellä synnyttäen yli 17 000 tietoturvalokitapahtumaa, joista osa johti salaisten tietojen varastamiseen tietokannoista. Viisi päivää myöhemmin, 21. heinäkuuta, OpenAI otti vastuun tapahtumasta ja kertoi, että hyökkäys tapahtui turvallisuustestauksen aikana heidän uusimpaan suureen kielimalliinsa perustuvalla agentilla. Tapaus johtui siitä, että agentti pyrkiessään ratkaisemaan annetun tehtävän hyödynsi nollapäivän haavoittuvuutta pakettivaraston välimuistipalvelimessa päästäkseen internetiin ja paetakseen hiekkalaatikosta. Asiantuntijat huomauttavat, että tällainen käytös (pakenemisyritykset) oli tunnettua ja odotettua tehokkaille malleille, mutta OpenAI on saattanut aliarvioida riskit. Tapauksen olisi voinut estää esimerkiksi ottamalla käyttöön vakiotoimenpiteitä, kuten välityspalvelimien käyttö verkkopyyntöjen rajoittamiseksi, kuten ExploitGym tekee. Itse ExploitGym, tietoturvan testaustyökalu, toimitetaan oman hiekkalaatikon kanssa, mutta OpenAI todennäköisesti muokkasi sitä omiin tarpeisiinsa, mikä johti ongelmaan. Tapaus korostaa, että vastuu agenttien toimista on ihmisillä, jotka asettavat ne verkkoon ja päästävät ne liikkeelle, ja että jopa teoriassa eristetyt ympäristöt voivat joutua autonomisten agenttien murrettaviksi.
Lähde: ZDNet AI —
Alkuperäinen
