AI-veiligheid 🇩🇪 12.08.2026 21:04

Architectuurfout in GPT-5, Claude en Gemini blootgelegd

OpenAIOpenAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind
Een internationaal onderzoeksteam heeft een architectuurfout ontdekt in de versleutelde Chain-of-Thought-redeneringsblokken van toonaangevende AI-modellen zoals GPT-5, Claude en Gemini. Door gebruik te maken van kleinere zustermodellen van dezelfde leveranciers kunnen aanvallers de volledige redeneerprocessen ontsleutelen en lezen, wat mogelijk gevoelige gegevens blootlegt.
Een internationaal onderzoeksteam heeft een kritieke architectuurkwetsbaarheid ontdekt in de versleutelde redeneerblokken van toonaangevende AI-systemen zoals GPT-5, Claude en Gemini. Deze systemen genereren een interne gedachtegang voordat ze antwoorden, die leveranciers versleutelen en naar de client sturen, alleen om met vervolgvragen terug te worden gestuurd. De onderzoekers ontdekten dat OpenAI, Anthropic en Google wereldwijde versleutelingssleutels gebruiken voor hun modelfamilies, wat betekent dat de versleutelde redeneerblokken niet zijn gekoppeld aan een specifieke gebruiker, sessie of model. Dit stelt aanvallers in staat om het versleutelde redeneerblok van een vlaggenschipmodel te nemen en het in te dienen bij een kleiner, minder beperkt zustermodel, dat vervolgens het volledige redeneerproces ontsleutelt en uitvoert. Het team analyseerde openbare repositories en logboeken, vond 315.320 versleutelde redeneerblokken en ontsleutelde met succes persoonlijke identificatiegegevens, API-sleutels, wachtwoorden en e-mailadressen. De kwetsbaarheid maakt ook verborgen promptinjecties en ongeautoriseerde klonen van modelmogelijkheden mogelijk. De onderzoekers meldden hun bevindingen aan de betrokken bedrijven, die zijn begonnen met het implementeren van tegenmaatregelen; totdat versleuteling echter strikt aan een specifieke sessie is gebonden, kunnen gebruikers niet op bescherming rekenen.
Bron: Heise online — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws