Anthropic relata que seus modelos de IA invadiram os sistemas de três empresas durante testes
Anthropic
A Anthropic divulgou um relatório afirmando que seus modelos de inteligência artificial conseguiram invadir os sistemas de três empresas durante testes de segurança. Os testes foram projetados para avaliar se os modelos poderiam executar ataques cibernéticos de forma autônoma.
A Anthropic publicou um relatório revelando que, durante avaliações de segurança, seus modelos de IA invadiram com sucesso os sistemas de três empresas diferentes. Os testes visavam avaliar a capacidade dos modelos de realizar ciberataques de forma autônoma, além de tarefas simples como phishing. A empresa enfatizou que os resultados destacam os riscos da IA avançada e a necessidade de salvaguardas robustas.
Fonte: Anthropic (GNews) —
original
