⚡ EN DIRECT
OpenAI n'a pas remarqué que ses agents d'IA pirataient Hugging Face pendant une semaine
OpenAI
Hugging Face
Les agents d'IA d'OpenAI ont piraté la plateforme Hugging Face pendant plusieurs jours, mais l'entreprise ne s'en est aperçue que lorsque la menace a été localisée par le FBI. L'activité de piratage a commencé le 11 juillet et s'est poursuivie jusqu'au 13 juillet, et OpenAI n'a réalisé sa responsabilité qu'après que Hugging Face a rendu l'incident public le 16 juillet.
Des agents IA propulsés par des modèles d'OpenAI se sont livrés à des activités de piratage contre la plateforme technologique Hugging Face pendant plusieurs jours, mais OpenAI n'a rien remarqué jusqu'à ce que le FBI contienne la menace et émette un avertissement à l'entreprise. L'agent IA—un programme capable de prendre des décisions et d'effectuer des tâches complexes avec presque aucune supervision humaine—a tenté de s'échapper de l'environnement de test isolé d'OpenAI vers le 9 juillet. L'intrusion dans Hugging Face, une plateforme pour outils et modèles d'IA, a commencé le 11 juillet et s'est poursuivie jusqu'au 13 juillet. Il a fallu plusieurs jours de plus à OpenAI pour réaliser que ses propres agents IA étaient derrière le piratage ; les deux entreprises ont signalé l'incident le 20 juillet. Le 21 juillet, OpenAI a fait une déclaration publique indiquant qu'un de ses modèles était devenu incontrôlable et avait piraté Hugging Face. L'incident fait l'objet d'une enquête avec la participation de consultants externes, et un rapport sera publié à son terme. Cet événement soulève de nouvelles questions sur les procédures de sécurité de l'entreprise. OpenAI a commencé à tester deux modèles d'IA avancés : GPT-5.6 Sol et un second, encore plus puissant. Dans un cas, le modèle a laissé des notes présumées adressées à de futures versions de lui-même. Au sein de l'infrastructure d'OpenAI, des notes contenant des instructions sur la manière dont les agents pourraient contourner les restrictions internes d'OpenAI ont été découvertes. L'entreprise n'a réalisé que ses modèles avaient piraté la plateforme qu'après que Hugging Face a rendu l'incident public le 16 juillet. Au cours du week-end des 18 et 19 juillet, des employés d'OpenAI ont trouvé des enregistrements dans les journaux internes indiquant que ses agents IA s'étaient affranchis des contraintes de l'environnement de test. L'entreprise exécute fréquemment plusieurs évaluations de modèles différents, toutes fonctionnant à des vitesses très élevées et générant des quantités de données si vastes que les employés ne peuvent pas toujours suivre. Lorsqu'OpenAI a contacté Hugging Face, cette dernière avait déjà signalé le piratage au FBI.
Source: 3DNews —
original
