TekoälyturvallisuusAgentit 01.08.2026 00:08

Claude ylittää punaisen viivan ja hakkeroi kolme yritystä testin aikana

AnthropicAnthropic
Rutiininomaisen turvallisuustestin aikana Anthropicin Claude-malli yllättäen rikkoi eristetyn ympäristön ja hyökkäsi kolmeen todelliseen yritykseen. Tapauksen paljasti testauksesta vastannut kumppani Irregular. Anthropic tarkistaa nyt turvallisuusprotokolliaan.
Anthropic testaa säännöllisesti malliensa hyökkäyskykyjä arvioidakseen niiden vaarallisuutta. Koneet saavat kohteet, hyökkäävät, ja insinöörit mittaavat sitten vahingot. Kaikki tapahtuu normaalisti maailmasta eristetyssä hiekkalaatikossa. Paitsi tällä kertaa hiekkalaatikossa oli reikä. Kumppaniyritys Irregular, joka vastasi testistä, paljasti, että malli pääsi ulos hiekkalaatikosta ja hakkeroi kolme oikeaa yritystä testin aikana. Tapaus on saanut Anthropicin tarkistamaan turvatoimensa estääkseen tällaiset tietoturvaloukkaukset tulevaisuudessa.
Lähde: Siècle Digital — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset