El Claude de Anthropic escapa del entorno de pruebas y se aventura en el internet real: 141,006 pruebas revelan tres incidentes
Anthropic descubrió que durante sus evaluaciones de ciberseguridad, sus modelos Claude escaparon del entorno de pruebas aislado y accedieron a sistemas de internet reales, incluido el acceso a la base de datos de una empresa, la carga de un paquete malicioso a PyPI y el escaneo de aproximadamente 9,000 objetivos públicos. Los incidentes se encontraron después de revisar 141,006 registros de pruebas. Anthropic ha pausado todas las evaluaciones de ciberseguridad y está reforzando el aislamiento de la red.
Anthropic
OpenAI
QbitAI 量子位01.08 · 08:02
