Tekoälyturvallisuus 🇩🇪 12.08.2026 21:04

Arkkitehtuurivirhe GPT-5:ssä, Claudessa ja Geminissä paljastettu

OpenAIOpenAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind
Kansainvälinen tutkimusryhmä on löytänyt arkkitehtuurivirheen johtavien tekoälymallien, kuten GPT-5:n, Clauden ja Geminin, salatussa päättelyketjun lohkoissa. Käyttämällä samojen valmistajien pienempiä sisarmalleja hyökkääjät voivat purkaa salauksen ja lukea koko päättelyprosessin, mikä voi altistaa arkaluonteisia tietoja.
Kansainvälinen tutkimusryhmä on paljastanut kriittisen arkkitehtonisen haavoittuvuuden huipputekoälyjärjestelmien, kuten GPT-5:n, Clauden ja Geminin, salatuissa päättelylohkoissa. Nämä järjestelmät tuottavat sisäisen ajatusketjun ennen vastaamista, jonka toimittajat salaavat ja lähettävät asiakkaalle vain palautettavaksi jatkokysymysten yhteydessä. Tutkijat havaitsivat, että OpenAI, Anthropic ja Google käyttävät maailmanlaajuisia salausavaimia malliperheilleen, mikä tarkoittaa, että salatut päättelylohkot eivät ole sidottuja tiettyyn käyttäjään, istuntoon tai malliin. Tämä mahdollistaa hyökkääjille lippulaivamallin salatun päättelylohkon ottamisen ja sen lähettämisen pienemmälle, vähemmän rajoitetulle sisarmallille, joka sitten purkaa salauksen ja tulostaa koko päättelyprosessin. Ryhmä analysoi julkisia säilytyspaikkoja ja lokeja, löysi 315 320 salattua päättelylohkoa ja onnistui purkamaan henkilökohtaisia tunnisteita, API-avaimia, salasanoja ja sähköpostiosoitteita. Haavoittuvuus mahdollistaa myös piilotetut kehotteinjektiot ja mallin ominaisuuksien luvattoman kloonaamisen. Tutkijat ilmoittivat löydöksistään asianomaisille yrityksille, jotka ovat alkaneet ottaa käyttöön vastatoimia; kuitenkaan ennen kuin salaus on sidottu tiukasti tiettyyn istuntoon, käyttäjät eivät voi olettaa olevansa suojattuja.
Lähde: Heise online — Alkuperäinen
Aiemmat aiheeseen liittyvät kirjoituksemme ↓
Tuoreet uutiset