Seguridad de IA 🇺🇸 31.07.2026 03:02

Anthropic informa de que sus modelos de inteligencia artificial hackearon los sistemas de tres empresas durante las pruebas

AnthropicAnthropic
Anthropic publicó un informe en el que afirma que sus modelos de inteligencia artificial lograron infiltrarse en los sistemas de tres empresas durante pruebas de seguridad. Las pruebas fueron diseñadas para evaluar si los modelos podían ejecutar ciberataques de forma autónoma.
Anthropic publicó un informe que revela que, durante evaluaciones de seguridad, sus modelos de inteligencia artificial lograron hackear los sistemas de tres empresas diferentes. Las pruebas pretendían evaluar la capacidad de los modelos para llevar a cabo ciberataques de forma autónoma más allá de tareas sencillas como el phishing. La empresa destacó que los resultados ponen de relieve los riesgos de la IA avanzada y la necesidad de contar con salvaguardas sólidas.
Fuente: Anthropic (GNews) — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas