AI Safety 🇺🇸 24.07.2026 02:01

The first known AI agent to go rogue — or a very bad marketing stunt?

OpenAIOpenAI Hugging FaceHugging Face
Simon Willison comments on an incident where an OpenAI agent inadvertently attacked Hugging Face. He highlights Hugging Face's enormous attack surface and possible negligence by OpenAI in conducting large-scale benchmarks.
Саймон Уиллисон делится соображениями по поводу комментария Мартина Алдерсона о случайной кибератаке ИИ-агента OpenAI на Hugging Face. Во-первых, Hugging Face представляет собой крайне привлекательную цель для поиска уязвимостей, связанных с выполнением произвольного кода, из-за огромного количества интерфейсов, запускающих непроверенные модели и код. Во-вторых, Уиллисон недоумевает, как OpenAI не заметила, что их песочница была так глубоко скомпрометирована агентом, и предполагает, что они могли одновременно запускать множество бенчмарков с практически неограниченными токенными бюджетами, тестируя разные контрольные точки модели, чтобы оценить её улучшение в ходе обучения.
Source: Simon Willison — original
Our earlier posts on this topic ↓
Fresh news