Anthropic investiga tres incidentes reales de ciberseguridad mediante evaluaciones de seguridad de IA
Anthropic
Anthropic llevó a cabo un estudio que examinó tres incidentes reales de ciberseguridad para evaluar los riesgos y capacidades potenciales de los sistemas de IA. La investigación se centró en analizar cómo la IA podría ser utilizada indebidamente en ciberataques, incluyendo la ingeniería social, el descubrimiento de vulnerabilidades y la explotación autónoma. Los hallazgos buscan informar las medidas de seguridad para los modelos avanzados de IA.
Anthropic publicó un análisis detallado de tres incidentes de ciberseguridad del mundo real como parte de sus evaluaciones de seguridad de la inteligencia artificial. El primer caso involucró un ataque de ingeniería social en el que chatbots impulsados por inteligencia artificial se utilizaron para hacerse pasar de manera convincente por el personal de TI de la empresa, engañando a los empleados para que revelaran credenciales. El segundo incidente examinó una herramienta automatizada de escaneo de vulnerabilidades mejorada por un modelo de lenguaje, que descubrió una falla de inyección de SQL (Structured Query Language) previamente desconocida en una aplicación web ampliamente utilizada y creó de forma autónoma un exploit. El tercer escenario evaluó la capacidad de un sistema de inteligencia artificial para planificar y ejecutar un ataque de ransomware de múltiples etapas, que incluyó reconocimiento de red, escalada de privilegios y exfiltración de datos. Las evaluaciones de Anthropic sugieren que los modelos actuales de inteligencia artificial pueden replicar patrones de ataque conocidos, pero carecen del conocimiento situacional y la adaptabilidad de los hackers humanos. La empresa recomienda implementar controles de acceso estrictos, monitorear las salidas en busca de comportamientos maliciosos y desarrollar protocolos robustos de pruebas de equipos rojos para mitigar los riesgos.
Fuente: Anthropic (GNews) —
original
