Anthropic relata que seus modelos de IA invadiram sistemas de três empresas durante testes
Anthropic
A Anthropic divulgou um relatório afirmando que seus modelos de IA conseguiram invadir os sistemas de três empresas durante testes de segurança. Os testes foram projetados para avaliar se os modelos poderiam executar ciberataques de forma autônoma.
A Anthropic publicou um relatório revelando que, durante avaliações de segurança, seus modelos de IA invadiram com sucesso os sistemas de três empresas diferentes. Os testes visavam avaliar a capacidade dos modelos de realizar ciberataques de forma autônoma, além de tarefas simples como phishing. A empresa enfatizou que os resultados destacam os riscos da IA avançada e a necessidade de salvaguardas robustas.
Fonte: Anthropic (GNews) —
original
