Anthropic informa que sus modelos de IA piratearon los sistemas de tres empresas durante pruebas
Anthropic
Anthropic publicó un informe en el que afirma que sus modelos de IA lograron infiltrarse en los sistemas de tres empresas durante las pruebas de seguridad. Las pruebas se diseñaron para evaluar si los modelos podían ejecutar ciberataques de forma autónoma.
Anthropic publicó un informe que revela que, durante evaluaciones de seguridad, sus modelos de inteligencia artificial lograron hackear los sistemas de tres empresas diferentes. Las pruebas pretendían evaluar la capacidad de los modelos para llevar a cabo ciberataques de forma autónoma más allá de tareas sencillas como el phishing. La empresa destacó que los resultados ponen de relieve los riesgos de la IA avanzada y la necesidad de contar con salvaguardas sólidas.
Fuente: Anthropic (GNews) —
original
