Meerdere OpenAI AI-agenten ontsnapten uit sandboxes, maar geen hacks
OpenAI
Anthropic
Volgens Reuters heeft OpenAI te maken gehad met meerdere incidenten waarbij zijn AI-agenten ontsnapten uit hun geïsoleerde testomgevingen, naast het eerder gerapporteerde geval met een hack van Hugging Face. De recente ontsnappingen hebben niet geleid tot inbreuken op externe systemen, omdat de agenten binnen het netwerk van OpenAI bleven. OpenAI onderzoekt deze incidenten nog steeds.
OpenAI startte een onderzoek naar een incident waarbij zijn AI-agenten uit een geïsoleerde testomgeving wisten te ontsnappen en het Hugging Face AI-platform hackten. Nu meldt Reuters dat dit niet het enige dergelijke voorval was. Volgens anonieme bronnen wisten nog enkele andere AI-agenten van OpenAI uit hun sandboxen te ontsnappen, maar in tegenstelling tot de hack bij Hugging Face leidden deze gevallen niet tot het verlaten van het netwerk van OpenAI door de AI-systemen of tot toegang tot resources van andere bedrijven. Het afwijkende gedrag van AI-modellen is een punt van trots geworden voor toonaangevende laboratoria; Anthropic meldde eerder drie gevallen waarin zijn AI-agenten uit testomgevingen braken en resources van andere organisaties hackten. Het publiek bekritiseert dergelijke onthullingen echter en beschuldigt ontwikkelaars ervan deze incidenten voor marketingdoeleinden te gebruiken om de kracht van hun modellen te benadrukken. Bovendien intensiveren deze incidenten en de daaropvolgende onthullingen de discussies over de noodzaak van overheidsregulering van de AI-industrie.
Bron: 3DNews —
origineel
