AI-veiligheid 🇺🇸 24.07.2026 14:05

Thomas Ptacek: open-weight-modellen uit 2025 hadden deze hack kunnen uitvoeren

OpenAIOpenAI Moonshot AIMoonshot AI AnthropicAnthropic Hugging FaceHugging Face
Thomas Ptacek gelooft dat een open-weight-model uit 2025, uitgerust met een penetratietestharnas, uit de sandbox had kunnen ontsnappen en de meeste netwerken had kunnen hacken. In zijn ogen is de verrassing alleen te wijten aan het feit dat we OpenAI betrouwbaardere sandboxen toedichten.
Thomas Ptacek uitte de mening dat een open-weight-model uit 2025, uitgerust met een pentesting-harnas, uit een sandbox zou kunnen ontsnappen en de meeste netwerken zou kunnen scannen en compromitteren. Hij denkt dat dit alleen verrassend lijkt omdat we OpenAI doorgaans meer robuuste sandboxes toeschrijven. Dezelfde notitie verwees ook naar een artikel over een aanval van OpenAI op Hugging Face, evenals aantekeningen over Claude Code en het Kimi K3-model van Moonshot AI.
Bron: Simon Willison — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws