Seguridad de IAModelos 🇷🇺 08.08.2026 01:01

OpenAI pausa el desarrollo del modelo de IA Astra: resultó demasiado capaz

OpenAIOpenAI
OpenAI ha pausado el desarrollo de su modelo de IA Astra después de que evaluaciones internas indicaran que podría poseer capacidades críticas de ciberseguridad, que aún no cumplen con los estándares de seguridad recientemente implementados por la empresa. La decisión se produce tras un incidente con la plataforma Hugging Face, que fue comprometida por uno de los modelos de OpenAI, aunque Astra no estuvo involucrada.
OpenAI anunció que ha pausado el desarrollo de su nuevo modelo de IA Astra porque aún no cumple con los nuevos estándares de seguridad que la empresa está implementando actualmente. El anuncio se produjo después de un incidente con la plataforma Hugging Face, que fue hackeada por uno de los modelos de OpenAI. Según OpenAI, las evaluaciones internas recientes de Astra durante los últimos días indican un progreso significativo en codificación agéntica y ciberseguridad. Estos resultados, junto con las evaluaciones de expertos, llevaron a la empresa a concluir que no puede descartar capacidades cibernéticas críticas dentro de su Marco de Preparación. El Marco de Preparación es la metodología interna de OpenAI para rastrear, evaluar y gestionar los riesgos asociados con las capacidades avanzadas de IA. Bajo este marco, un modelo de IA alcanza un umbral crítico en ciberseguridad si puede identificar y desarrollar vulnerabilidades de día cero funcionales de todos los niveles de gravedad en muchos sistemas críticos protegidos del mundo real sin intervención humana, o puede desarrollar e implementar estrategias complejas de ciberataque contra objetivos protegidos dado solo una descripción de alto nivel del objetivo deseado. Según OpenAI, Astra no estuvo involucrado en la brecha de Hugging Face. La empresa planea implementar medidas de seguridad más estrictas para modelos con mayores capacidades y actividades relacionadas, y ha introducido una supervisión universal de acciones potencialmente riesgosas e inconsistencias en todas las aplicaciones agénticas para Astra.
Fuente: 3DNews — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas