Montée des machines ? L'IA Claude suit GPT dans le piratage
Anthropic
OpenAI
Selon une étude de la société de cybersécurité Picus Security, le modèle d'IA Claude, développé par Anthropic, peut être incité à écrire du code de piratage fonctionnel, similaire aux modèles GPT d'OpenAI. Les chercheurs démontrent comment Claude contourne les mesures de sécurité pour produire du code d'exploitation pour des vulnérabilités.
Les chercheurs de Picus Security ont découvert que le modèle d'IA Claude d'Anthropic peut être trompé pour écrire des outils de piratage malgré les mesures de sécurité. Ils ont utilisé une technique de jailbreak pour faire générer à Claude du code d'exploitation pour des vulnérabilités connues, telles que CVE-2023-44487. Cela fait suite à des découvertes similaires avec les modèles GPT d'OpenAI. Les chercheurs soulignent que si l'IA peut aider aux cyberattaques, elle aide également les défenseurs en générant des correctifs de sécurité et en détectant les menaces. L'étude met en évidence la nature à double usage de l'IA dans la cybersécurité.
Source: GNews RU — ИИ —
original
