Falha de arquitetura em GPT-5, Claude e Gemini exposta
OpenAI
Anthropic
Google/DeepMind
Uma equipe internacional de pesquisadores descobriu uma falha arquitetural nos blocos criptografados de raciocínio em cadeia (Chain of Thought) dos principais modelos de IA, como GPT-5, Claude e Gemini. Ao usar modelos irmãos menores dos mesmos fornecedores, atacantes podem descriptografar e ler todos os processos de raciocínio, potencialmente expondo dados sensíveis.
Uma equipe internacional de pesquisa revelou uma vulnerabilidade arquitetural crítica nos blocos de raciocínio criptografados dos principais sistemas de IA, como GPT-5, Claude e Gemini. Esses sistemas geram uma Cadeia de Pensamento interna antes de responder, que os fornecedores criptografam e enviam ao cliente apenas para serem devolvidos com consultas de acompanhamento. Os pesquisadores descobriram que OpenAI, Anthropic e Google usam chaves de criptografia globais para suas famílias de modelos, o que significa que os blocos de raciocínio criptografados não estão vinculados a um usuário, sessão ou modelo específico. Isso permite que atacantes peguem o bloco de raciocínio criptografado de um modelo principal e o submetam a um modelo irmão menor e menos restrito, que então descriptografa e exibe o processo de raciocínio completo. A equipe analisou repositórios públicos e logs, encontrando 315.320 blocos de raciocínio criptografados, e conseguiu descriptografar identificadores pessoais, chaves de API, senhas e endereços de e-mail. A vulnerabilidade também permite injeções de prompt ocultas e clonagem não autorizada das capacidades do modelo. Os pesquisadores divulgaram suas descobertas às empresas afetadas, que começaram a implementar contramedidas; no entanto, até que a criptografia seja estritamente vinculada a uma sessão específica, os usuários não podem presumir proteção.
Fonte: Heise online —
original
