Fichier envoyé par erreur à une IA — licenciement. Comment fonctionne la sécurité des données en IA
DeepSeek
OpenAI
Google/DeepMind
Les employés transmettent de plus en plus de données d'entreprise à des services d'IA publics, souvent sans règles ni compréhension des flux de données. Un exemple récent : un haut dirigeant a été licencié pour avoir téléversé des documents professionnels sur DeepSeek. L'article explique où vont les données, qui peut les voir, et pourquoi la suppression est souvent irréversible.
L'article de Daria Lushkina de RuNet Rating examine la sécurité des données lors de l'utilisation de réseaux neuronaux. Il note une étude qui a révélé que les employés de 150 entreprises russes ont téléchargé 30 fois plus de données d'entreprise sur des services d'IA publics en 2025 qu'un an auparavant, et que 60 % des entreprises n'ont pas de règles d'utilisation de l'IA. En juillet, un cadre supérieur d'une entreprise d'ingénierie de Moscou a été licencié pour avoir téléchargé des documents de travail sur DeepSeek, et le tribunal a donné raison à l'employeur. L'article détaille le processus de traitement des données : les fichiers sont analysés, le texte est extrait, divisé en fragments, puis converti en embeddings, laissant des traces dans les journaux et les stockages. Les données peuvent être vulnérables lors du stockage, dans les journaux, les chaînes tierces et l'entraînement. La suppression est complexe : supprimer une conversation ne supprime pas toutes les copies, et si les données ont été utilisées pour l'entraînement, leur influence est irréversible. L'article aborde également le désapprentissage machine comme direction de recherche. Il note que des modérateurs humains peuvent examiner les conversations, comme c'est le cas pour Gemini de Google, et que des partenaires d'infrastructure, tels que les fournisseurs de cloud, ont accès aux données. Il mentionne une violation de données de DeepSeek en 2023 où plus d'un million de lignes de journaux de chat et de clés ont été exposées. Des ingénieurs de Samsung ont envoyé du code source à ChatGPT, et un responsable d'une agence de cybersécurité américaine a téléchargé des documents sensibles. L'auteur conseille la prudence et une compréhension des politiques de données.
Source: Habr — хаб ИИ —
original
