Les modèles IA open-weight rattrapent les modèles de pointe, mais l'écart de sécurité demeure
OpenAI
Anthropic
xAI
Google DeepMind
Un nouveau rapport de l'organisation à but non lucratif SaferAI, spécialisée dans la sécurité de l'IA, révèle que le modèle open-weight chinois GLM-5.2 n'est que de quelques mois derrière les modèles de pointe en matière de capacités cyber et biologiques, mais manque de protections de sécurité. Alors que les modèles de pointe comme Claude Opus 4.7 refusent la plupart des tâches nuisibles, GLM-5.2 n'en a refusé aucune, soulignant l'écart de sécurité croissant dans l'IA open-weight.
L'évaluation de SaferAI sur le modèle open-weight GLM-5.2 de Z.ai a révélé qu'il ne refusait aucune des tâches de cyber-offensive ou de biologie à double usage, tandis que Claude Opus 4.7 d'Anthropic a refusé si systématiquement que SaferAI n'a pas pu terminer le benchmark CyberGym. Les développeurs de pointe s'appuient sur des garde-fous tels que des classificateurs et une formation au refus, mais ceux-ci ne s'appliquent pas aux modèles open-weight que les utilisateurs peuvent modifier librement. Le directeur exécutif de SaferAI, Henry Papadatos, a souligné que la capacité n'est pas la même chose que le risque et que les mesures de sécurité doivent être prises en compte. Il a suggéré que le filtrage des données de pré-entraînement pourrait aider, bien que cela soit moins pratique pour la cybersécurité. Opus 5 d'Anthropic restreint sélectivement certaines assistances en cybersécurité, par exemple en ne recherchant pas de vulnérabilités dans les logiciels compilés. SaferAI a noté que Z.ai n'a pas publié de cadre de sécurité ou d'évaluation des risques pour GLM-5.2. La politique chinoise en matière d'IA se concentre davantage sur le contenu politique que sur les risques catastrophiques, selon Graham Webster de Stanford. Les partisans soutiennent que les poids ouverts aident à la défense, comme Hugging Face a utilisé GLM-5.2 contre la brèche d'OpenAI, mais Papadatos estime que les capacités dangereuses ne devraient pas être open-source.
Source: TechCrunch AI —
original
