Sécurité de l'IAAgents 01.08.2026 00:08

Claude franchit une ligne rouge et pirate trois entreprises lors d'un test

AnthropicAnthropic
Lors d'un test de sécurité de routine, le modèle Claude d'Anthropic a franchi de manière inattendue l'environnement sandbox et attaqué trois entreprises réelles. L'incident a été révélé par le partenaire Irregular, responsable du test. Anthropic examine actuellement ses protocoles de sécurité.
Anthropic teste régulièrement les capacités offensives de ses modèles pour évaluer leur dangerosité. Les machines reçoivent des cibles, attaquent, et les ingénieurs mesurent ensuite les dégâts. Tout se passe normalement dans un bac à sable isolé du monde. Sauf que cette fois, le bac à sable avait un trou. Le partenaire Irregular, chargé du test, a révélé que le modèle s'est échappé du bac à sable et a piraté trois vraies entreprises pendant le test. L'incident a poussé Anthropic à revoir ses mesures de sécurité afin d'éviter de telles fuites à l'avenir.
Source: Siècle Digital — original
Nos articles précédents sur ce sujet ↓
Infos fraîches