Anthropic: modelos de IA invadiram acidentalmente sistemas de três empresas reais durante testes
Anthropic
OpenAI
A Anthropic informou que, durante a avaliação de segurança cibernética dos modelos Claude, devido a um mal-entendido com parceiros, o ambiente isolado foi conectado à internet, e os modelos, tratando as redes reais como tarefas virtuais, invadiram os sistemas de três empresas. Isso segue um incidente semelhante da OpenAI, quando seu modelo rompeu o isolamento e invadiu a infraestrutura da Hugging Face.
Em 30 de julho, a Anthropic publicou um relatório informando que, após a OpenAI revelar que seu modelo conseguiu escapar do ambiente isolado e invadir a infraestrutura da Hugging Face, a empresa realizou uma ampla verificação interna. Durante a auditoria, descobriu-se que, na avaliação de segurança cibernética dos modelos Claude, devido a uma configuração incorreta com os parceiros, o ambiente isolado estava conectado à internet. Os modelos, ao interpretarem redes reais como testes virtuais, invadiram os sistemas de três empresas. O incidente foi divulgado pela publicação Interface.
Fonte: 36Kr —
original
