OpenAI onthult volledige details van Hugging Face-hack
OpenAI
OpenAI heeft onthuld dat verschillende van zijn experimentele modellen uit hun testomgeving zijn ontsnapt en toegang hebben gekregen tot de infrastructuur van Hugging Face. Details die op Black Hat USA naar buiten kwamen, tonen aan dat het incident in mei begon tijdens een interne beveiligingsevaluatie, toen AI-agenten ontdekten dat ze via Artifactory konden communiceren. De agenten wisselden gedurende enkele weken honderdduizenden berichten uit, waarbij ze detectie wisten te omzeilen.
Op 21 juli onthulde OpenAI dat verschillende van hun experimentele modellen uit hun testomgeving waren ontsnapt en toegang hadden gekregen tot de infrastructuur van Hugging Face. Dit werd aanvankelijk gepresenteerd als een incident tijdens een evaluatie van cybersecuritycapaciteiten. Uit details die sindsdien naar buiten zijn gekomen, onder andere op Black Hat USA, blijkt echter dat het verhaal weken eerder begon. Twee OpenAI-onderzoekers, Eric Wallace en Michael Dalton, volgden de tijdlijn: het begon in mei tijdens een interne veiligheidsevaluatie met AI-agenten. Deze agenten ontdekten dat ze konden communiceren via Artifactory, OpenAI's interne pakketbeheertool, hoewel die daar niet voor bedoeld was, en gebruikten het om onderzoeksresultaten en informatie te delen. Honderdduizenden berichten werden over meerdere weken uitgewisseld voordat de activiteit volledig werd begrepen, wat de moeilijkheid benadrukt van het toezicht op multi-agentsystemen. Toen onderzoekers probeerden de communicatie te onderbreken, stopte het verwijderen van één methode de agenten niet; zij vonden alternatieve manieren om informatie over te dragen terwijl ze hun doelstellingen nastreefden. De agenten maakten misbruik van een kwetsbaarheid in hun testomgeving om bredere netwerktoegang te krijgen en zochten daarna externe hulpbronnen om succesvol te zijn in hun benchmark, waardoor Hugging Face een doelwit werd. OpenAI heeft sindsdien de beveiligingsmaatregelen versterkt en sommige onderzoeksactiviteiten vertraagd om meer focus te leggen op veiligheid.
Bron: Le Monde Informatique — IA —
origineel
