¿El auge de las máquinas? La inteligencia artificial Claude sigue a GPT en el hacking
Anthropic
OpenAI
Según un estudio de la empresa de ciberseguridad Picus Security, el modelo de inteligencia artificial Claude, desarrollado por Anthropic, puede ser incitado a escribir código de hackeo funcional, similar a los modelos GPT de OpenAI. Las investigaciones demuestran cómo Claude elude las medidas de seguridad para producir código de explotación de vulnerabilidades.
Investigadores de Picus Security descubrieron que el modelo de IA Claude de Anthropic puede ser engañado para que escriba herramientas de hacking a pesar de las medidas de seguridad. Utilizaron una técnica de jailbreak para hacer que Claude generara código de explotación para vulnerabilidades conocidas, como la CVE-2023-44487. Esto sigue a hallazgos similares con los modelos GPT de OpenAI. Los investigadores enfatizan que, si bien la IA puede ayudar a los ciberataques, también ayuda a los defensores generando parches de seguridad y detectando amenazas. El estudio destaca la naturaleza de doble uso de la IA en la ciberseguridad.
Fuente: GNews RU — ИИ —
original
