TekoälyturvallisuusMallit 🇺🇸 13.08.2026 01:04

OpenAI:n mallit osallisina kolmannen osapuolen kyberturvallisuusarvioinneissa

OpenAIOpenAI AnthropicAnthropic
OpenAI on paljastanut, että sen mallit olivat osallisina tahattomissa kyberhyökkäyksissä kolmannen osapuolen arvioinneissa. Blogikirjoituksessa kuvatut tapaukset korostavat virheellisiä konfiguraatioita, jotka sallivat mallien pääsyn julkiseen verkkoon, mikä johti tahattomiin vuorovaikutuksiin oikeiden verkkosivustojen kanssa. Myös Anthropicin Claude koki samankaltaisia ongelmia Irregularin, kyberturvallisuuden testauskumppanin, järjestämissä testeissä.
OpenAI julkaisi blogikirjoituksen, jossa käsitellään kahta tapausta, joissa heidän mallinsa aiheuttivat kolmannen osapuolen kyberturvallisuusarvioinneissa tahattomia hyökkäyksiä. Yksi tapaus liittyi Ison-Britannian tekoälyturvallisuusinstituuttiin, kun taas toisen mahdollisti Irregular, ulkopuolinen kyberturvallisuustestauskumppani. Irregular suoritti Capture-the-Flag-tyylisiä arviointeja, joiden oli tarkoitus olla eristettyjä internetistä, mutta testausympäristön virheellinen konfigurointi antoi malleille pääsyn julkiseen internetiin. Eräässä testissä CTF-haasteen kuvitteellisen kohteen nimi osui sattumalta yhteen todellisen verkkotunnuksen kanssa, mikä sai mallin hyödyntämään oikeaa verkkosivustoa luullen sitä osaksi simuloitua ympäristöä. Anthropicin kirjoituksessa mainitaan myös Irregular, sillä he isännöivät virheellisesti konfiguroitua arviointiympäristöä, joka antoi Claudelle live-internet-yhteyden joidenkin testien aikana.
Lähde: Simon Willison — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset