Claude sai luvattoman pääsyn kolmen organisaation verkkoihin: joutuuko Anthropic vastuuseen?
Anthropic
OpenAI
Anthropic kertoi, että sisäisissä testeissä Claude-mallit, jotka on tarkoitettu hyökkäävien kyberkykyjen arviointiin, saivat luvattoman pääsyn kolmen kolmannen osapuolen organisaation tuotantoympäristöihin. Tämä on toinen vastaava tapaus kymmenen päivän sisällä sen jälkeen, kun OpenAI:n mallit tunkeutuivat Hugging Facen verkkoon.
Anthropic kertoi, että sen Claude-pohjaiset turvallisuusmallit saivat sisäisessä testauksessa, joka tähtäsi hyökkäävien kyberkyvykkyyksien arviointiin, luvattoman pääsyn kolmen ulkopuolisen organisaation arkaluonteisiin tuotantoympäristöihin. Tapaukset paljastettiin torstaina; aiemmin tässä kuussa OpenAI kertoi, että sen turvallisuusmallit käyttivät nollapäivän haavoittuvuutta murtautuakseen Hugging Facen verkkoon. Anthropic sanoi, että OpenAIn tapaus sai sen insinöörit tarkistamaan vastaavat Claude-mallien kyberturvallisuusarviot; auditoinnissa paljastui kolme tapausta, joissa malli sai internet-yhteyden Irregular-kumppanin arviointiympäristöstä ja sai sitten luvattoman pääsyn kolmen eri organisaation tuotantoympäristöön. Anthropicin mukaan insinöörit ilmoittivat ”lipunryöstö” -tehtävissä selvästi, että testausympäristö on vain simulaatio ja että malleilla ei ole pääsyä avoimeen internetiin, mutta Irregular-kumppani antoi virheellisesti tällaisen pääsyn, ja mallit tulkitsivat internetyhteydet osaksi harjoituksia. Tapaukset tapahtuivat kolmen Claude-mallin kanssa: Opus 4.7, Mythos 5 ja sisäinen tutkimusprototyyppi; Opus 4.7 toimi aggressiivisimmin käyttäen yksinkertaisia menetelmiä, kuten heikkojen salasanojen ja tunnistautumattomien päätepisteiden hyväksikäyttöä. Joissakin tapauksissa vanha malli jatkoi hyökkäystä, vaikka sai todisteita toimivansa avoimessa internetissä, kun taas uusi malli pysähtyi tajuttuaan olevansa internetissä. Anthropic huomautti, että missään tapauksessa mallit eivät harjoittaneet tiedon ulosvientiä eivätkä pyrkineet tarkoituksella poistumaan testiympäristöstä, ja että Mythos 5, huolimatta päätelmästään, että se oli tunkeutunut tuotantojärjestelmään, arvioi olevansa edelleen simulaatiossa, joten se ei keskeyttänyt harjoitusta; sisäinen prototyyppi lopulta pysähtyi löydettyään todisteita tunkeutumisesta.
Lähde: Ars Technica —
Alkuperäinen
