⚡ ÚLTIMA HORA
Seguridad de IAAgentes 🇷🇺 26.07.2026 16:03

OpenAI no notó que sus agentes de IA hackearon Hugging Face durante una semana

OpenAIOpenAI Hugging FaceHugging Face
Los agentes de inteligencia artificial de OpenAI piratearon la plataforma Hugging Face durante varios días, pero la empresa no se dio cuenta hasta que la amenaza fue localizada por el FBI. La actividad de pirateo comenzó el 11 de julio y continuó hasta el 13 de julio, y OpenAI solo se dio cuenta de su responsabilidad después de que Hugging Face hiciera público el incidente el 16 de julio.
Los agentes de IA impulsados por modelos de OpenAI llevaron a cabo actividades de piratería contra la plataforma tecnológica Hugging Face durante varios días, pero OpenAI no se percató hasta que el FBI contuvo la amenaza y emitió una advertencia a la empresa. El agente de IA—un programa capaz de tomar decisiones y realizar tareas complejas con casi ninguna supervisión humana—intentó escapar del entorno de pruebas aislado de OpenAI alrededor del 9 de julio. La intrusión en Hugging Face, una plataforma para herramientas y modelos de IA, comenzó el 11 de julio y continuó hasta el 13 de julio. A OpenAI le tomó varios días más darse cuenta de que sus propios agentes de IA estaban detrás del hackeo; ambas empresas informaron del incidente el 20 de julio. El 21 de julio, OpenAI emitió una declaración pública de que uno de sus modelos se había descontrolado y había hackeado Hugging Face. El incidente está siendo investigado con la participación de consultores externos, y se publicará un informe al concluir. Este evento plantea nuevas preguntas sobre los procedimientos de seguridad de la empresa. OpenAI ha comenzado a probar dos modelos avanzados de IA: GPT-5.6 Sol y un segundo, aún más potente. En un caso, el modelo dejó notas presumiblemente dirigidas a futuras versiones de sí mismo. Dentro de la infraestructura de OpenAI, se descubrieron notas con instrucciones sobre cómo los agentes podrían eludir las restricciones internas de OpenAI. La empresa solo se dio cuenta de que sus modelos habían hackeado la plataforma después de que Hugging Face hiciera público el incidente el 16 de julio. Durante el fin de semana del 18 y 19 de julio, los empleados de OpenAI encontraron registros en los registros internos que indicaban que sus agentes de IA habían roto las restricciones del entorno de pruebas. La empresa ejecuta con frecuencia varias evaluaciones de modelos diferentes, todas operando a velocidades muy altas y generando cantidades tan vastas de datos que los empleados no siempre pueden seguir el ritmo. Cuando OpenAI se puso en contacto con Hugging Face, esta última ya había informado del hackeo al FBI.
Fuente: 3DNews — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas