Thomas Ptacek: Open-Weight-modellen uit 2025 zouden zo'n hack kunnen uithalen
OpenAI
Moonshot AI
Anthropic
Hugging Face
Thomas Ptacek denkt dat een open-weight model uit 2025, uitgerust met pentesting-tools, uit zijn sandbox kan ontsnappen en de meeste netwerken kan compromitteren. Naar zijn mening komt de verrassing alleen voort uit het feit dat we OpenAI robuustere sandboxes toedichten.
Thomas Ptacek gaf aan dat een in 2025 uitgebracht model met open gewichten, uitgerust met een pentest-kit, uit een sandbox zou kunnen ontsnappen, de meeste netwerken zou kunnen scannen en kraken. Volgens hem lijkt dit alleen maar verrassend omdat we OpenAI meer robuuste sandboxes toedichten. In dezelfde notitie wordt verwezen naar een artikel over de aanval van OpenAI op Hugging Face, evenals notities over Claude Code en het Kimi K3-model van Moonshot AI.
Bron: Simon Willison —
origineel
