AI-mallien 'yli-ajattelulle' altistuminen luo tietoturva-aukon
DeepSeek
Alibaba/Qwen
OpenAI
Google/DeepMind
Zhejiangin yliopiston ja Alibaba-tutkijat ovat osoittaneet menetelmän, jolla tarkoituksellisesti aiheutetaan 'yli-ajattelua' päättelyä tekevissä AI-malleissa altistamalla ne loogisesti epäjohdonmukaisille kehotteille. Tämä evolutiivinen kehotehyökkäys voi aiheuttaa jopa 26 kertaa pidempiä tulosteita, mikä toimii käytännössä palvelunestohyökkäyksenä kaupallisille AI-palveluille.
Laajat kielimallit, jotka käyttävät askel askeleelta päättelyä, ovat alttiita ilmiölle nimeltä 'yliajattelu', jossa ne tuottavat tarpeettoman pitkiä päättelyketjuja. Zhejiangin yliopiston ja Alibaban tutkijat kehittivät evolutiivisen algoritmin, joka turmelee kehotteiden loogista rakennetta, saaden mallit ajautumaan hedelmättömiin päättelysilmukoihin. Hyökkäys tehoaa DeepSeekin (R1), Alibaban (Qwen3-Thinking), OpenAI:n (GPT-o3) ja Googlen (Gemini 2.5 Flash) malleihin, tuottaen jopa 26,1 kertaa pidempiä tulosteita matematiikan vertailuaineistossa. Menetelmä ei vaadi pääsyä mallien sisäisiin toimintoihin ja voi siirtyä mallien välillä, mikä lisää sen toteutettavuutta. Tutkijat kuitenkin korostavat, että heidän tavoitteenaan on tuoda esiin haavoittuvuus, ei kehittää käytännöllistä hyökkäystä, ja he toivovat palveluntarjoajien kehittävän lievennystoimia.
Lähde: IEEE Spectrum AI —
Alkuperäinen
