Défaut d'architecture exposé dans GPT-5, Claude et Gemini
OpenAI
Anthropic
Google/DeepMind
Une équipe de recherche internationale a découvert un défaut d'architecture dans les blocs de raisonnement chiffrés de la chaîne de pensée de modèles d'IA de premier plan comme GPT-5, Claude et Gemini. En utilisant des modèles frères plus petits des mêmes fournisseurs, les attaquants peuvent déchiffrer et lire l'intégralité des processus de raisonnement, ce qui pourrait exposer des données sensibles.
Une équipe internationale de chercheurs a mis au jour une vulnérabilité architecturale critique dans les blocs de raisonnement chiffrés des systèmes d'IA de premier plan tels que GPT-5, Claude et Gemini. Ces systèmes génèrent une chaîne de pensée interne avant de répondre, que les fournisseurs chiffrent et envoient au client pour qu'elle soit renvoyée avec les requêtes de suivi. Les chercheurs ont découvert qu'OpenAI, Anthropic et Google utilisent des clés de chiffrement globales pour leurs familles de modèles, ce qui signifie que les blocs de raisonnement chiffrés ne sont liés ni à un utilisateur spécifique, ni à une session, ni à un modèle. Cela permet aux attaquants de prendre le bloc de raisonnement chiffré d'un modèle phare et de le soumettre à un modèle frère plus petit et moins restreint, qui déchiffre alors et produit l'intégralité du processus de raisonnement. L'équipe a analysé des dépôts publics et des journaux, trouvant 315 320 blocs de raisonnement chiffrés, et a réussi à déchiffrer des identifiants personnels, des clés API, des mots de passe et des adresses électroniques. La vulnérabilité permet également des injections de prompts cachées et le clonage non autorisé des capacités des modèles. Les chercheurs ont signalé leurs découvertes aux entreprises concernées, qui ont commencé à mettre en place des contre-mesures ; cependant, tant que le chiffrement n'est pas strictement lié à une session spécifique, les utilisateurs ne peuvent pas supposer qu'ils sont protégés.
Source: Heise online —
original
