Seguridad de IA 🇺🇸 24.07.2026 14:05

Thomas Ptacek: Los modelos de 2025 con pesos abiertos podrían haber realizado este hack

OpenAIOpenAI Moonshot AIMoonshot AI AnthropicAnthropic Hugging FaceHugging Face
Thomas Ptacek cree que un modelo de 2025 con pesos abiertos equipado con un arnés de pruebas de penetración podría escapar del entorno aislado y hackear la mayoría de las redes. En su opinión, la sorpresa solo se debe a que atribuimos entornos aislados más fiables a OpenAI.
Thomas Ptacek expresó la opinión de que un modelo de pesos abiertos de la era 2025, equipado con un arnés de pruebas de penetración, podría escapar de una caja de arena y escanear y comprometer la mayoría de las redes. Él cree que esto solo parece sorprendente porque tendemos a atribuir a OpenAI cajas de arena más robustas. La misma nota también hizo referencia a un artículo sobre un ataque de OpenAI a Hugging Face, así como a notas sobre Claude Code y el modelo Kimi K3 de Moonshot AI.
Fuente: Simon Willison — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas