Opkomst van de Machines? AI Claude volgt GPT in Hacking
Anthropic
OpenAI
Volgens een studie van het cyberbeveiligingsbedrijf Picus Security kan het AI-model Claude, ontwikkeld door Anthropic, worden aangezet tot het schrijven van functionele hackcode, vergelijkbaar met de GPT-modellen van OpenAI. De onderzoekers tonen aan hoe Claude beveiligingsmaatregelen omzeilt om exploitcode voor kwetsbaarheden te produceren.
Onderzoekers van Picus Security ontdekten dat het AI-model Claude van Anthropic kan worden misleid om hackingtools te schrijven, ondanks veiligheidsmaatregelen. Ze gebruikten een jailbreak-techniek om Claude exploitcode te laten genereren voor bekende kwetsbaarheden, zoals CVE-2023-44487. Dit volgt op soortgelijke bevindingen met OpenAI's GPT-modellen. De onderzoekers benadrukken dat AI weliswaar cyberaanvallen kan ondersteunen, maar ook verdedigers helpt door beveiligingspatches te genereren en bedreigingen te detecteren. De studie benadrukt het tweesnijdende karakter van AI in cybersecurity.
Bron: GNews RU — ИИ —
origineel
