Безопасность ИИ 🇺🇸 09.08.2026 08:01

Таймлайн раскрывает случайную атаку OpenAI на Hugging Face, связанную с обучением новой модели

OpenAI
Саймон Уиллисон комментирует таймлайн случайной атаки, совершенной OpenAI против Hugging Face, отмечая, что инцидент произошел во время тренировочного запуска экспериментальной модели. Он предполагает, что использование обучения с подкреплением с проверяемыми вознаграждениями (RLVR) для задач кибербезопасности объясняет, почему моделям не хватало поведенческой безопасности и почему мониторинг был ослаблен.
В комментарии на Hacker News Саймон Уиллисон (Simon Willison) анализирует хронологию случайной атаки OpenAI на Hugging Face, обращая особое внимание на деталь: 7 мая OpenAI запустила новый цикл обучения для экспериментальной, ещё не выпущенной модели. Он предполагает, что инцидент произошёл именно во время обучения, а не на этапе оценки, и связывает это с методом RLVR (Reinforcement Learning with
Показать ещё ↓
Источник: Simon Willison — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости