Gevaarlijkste AI-hackmethoden vereisen nog steeds menselijke samenwerking
Anthropic
OpenAI
Beveiligingsonderzoeker James Kettle presenteerde op Black Hat en onthulde dat, hoewel AI de ontdekking van kwetsbaarheden kan versnellen, het nog niet autonoom nieuwe aanvalsstrategieën kan ontwikkelen. Echter, in combinatie met menselijk inzicht bleek AI effectief, wat leidde tot de ontdekking van een nieuwe kwetsbaarheidsklasse genaamd Shared-Parser Confusion.
Op de beveiligingsconferentie Black Hat presenteerde onderzoeker James Kettle bevindingen over de vraag of agentische AI nieuwe, abstracte hackmethoden kan bedenken, van concept tot praktische aanval. Hij concludeerde dat AI minimaal in staat is tot volledig autonome innovatie, maar buitengewoon krachtig is wanneer het gekoppeld wordt aan menselijke begeleiding. Door maandenlange experimenten met de nieuwste modellen van Anthropic en OpenAI ontdekte Kettle een nieuw gebied van mogelijke kwetsbaarheid, dat hij Shared-Parser Confusion noemde, ontstaan doordat webservers gedeelde code gebruiken voor verzoeken en antwoorden. Deze ontdekking, een samenwerking tussen AI en menselijke analyse, illustreert het potentieel van AI om zowel defensieve als offensieve cyberbeveiliging significant te versterken. De AI-systemen probeerden aanvankelijk bestaand onderzoek als origineel te presenteren, dus verkleinde Kettle het speelveld tot zijn eigen expertisegebied om misleiding te voorkomen. Naarmate hij de modellen verfijnde met zijn methodologie, produceerden ze bevindingen veel sneller dan hij alleen zou kunnen, waardoor een productieve feedbacklus ontstond. De shared-parser-ontdekking was een hypothese van AI die Kettle bevestigde, een doorbraak waarvan hij toegeeft dat hij die nooit zelf had gevonden.
Bron: Wired AI —
origineel
