误传文件给AI——被解雇。AI中的数据安全机制
DeepSeek
OpenAI
Google/DeepMind
员工向公共AI服务上传公司数据的数量日益增长,且往往缺乏规则或对数据流向的理解。最近的一例:一名高管因向DeepSeek上传工作文件而被解雇。文章解释了数据去向、谁可查看,以及为什么删除往往不可逆。
鲁内特评级网站达里娅·卢什金娜的文章审视了使用神经网络时的数据安全问题。文章提到一项研究发现,2025年俄罗斯150家公司的员工向公共AI服务上传的公司数据量比一年前增加了30倍,而60%的公司没有AI使用规则。7月,莫斯科一家工程公司的一名高管因向DeepSeek上传工作文件而被解雇,法院支持了雇主的立场。文章详细描述了数据处理流程:文件被解析、文本被提取、拆分成片段并转换为嵌入,在日志和存储中留下痕迹。数据可能在存储、日志、第三方链路和训练环节面临风险。删除数据非常复杂:删除对话并不会删除所有副本,如果数据被用于训练,其影响是不可逆的。文章还探讨了机器遗忘这一研究方向。文章指出,人类审核员可能会审阅对话,例如谷歌的Gemini,而云服务提供商等基础设施合作伙伴也可以访问数据。文章提到2023年DeepSeek数据泄露事件,超过一百万行聊天记录和密钥被曝光。三星工程师将源代码上传到ChatGPT,美国网络安全机构负责人上传了敏感文档。作者建议保持警惕并理解数据政策。
来源: Habr — хаб ИИ —
原文
