加密被绕过:AI模型如何轻易暴露用户敏感数据
Anthropic
OpenAI
Google/DeepMind
德国研究人员发现了一种方法,能够利用ChatGPT、Claude和Gemini等模型所使用的加密“推理日志”从中提取密码和API密钥等敏感数据。该攻击通过复制这些日志,并将其与同一公司旧版或修改版模型配合使用,从而有效破解加密。团队成功解密了超过31.5万条日志,揭示了62个API密钥、33个密码及其他个人信息。
德国研究人员发表了一篇题为《从专有LLM API窃取推理痕迹》的论文,展示了来自Anthropic、OpenAI和Google的AI模型如何泄露敏感用户数据。在执行推理任务时,这些模型会生成一串称为“推理日志”的加密字符串,该字符串随每个新响应发送回服务器以提供上下文。研究人员发现,推理日志可以被复制并用于同一家公司的其他模型中,包括旧版本或修改过的版本。如果修改后的模型通过越狱方式移除了其安全措施,它就能解码这些日志的加密。利用GitHub和Hugging Face上的6,708个公共仓库,他们成功解密了315,320条推理日志,其中包含62个API密钥、33个密码、24个访问令牌、30个个人电子邮件地址以及项目维护者的姓名和地址。其中许多细节仅存在于推理日志中,并未出现在聊天会话的其他部分。Cybernews的安全专家Voldemaras Kadys指出,加密并非在传统意义上被破解,而是因为兼容模型之间共享加密的推理痕迹,使得较弱的模型成为解密的主密钥。他建议将推理日志视为敏感数据,切勿分享。
来源: t3n —
原文
