Anthropic раскрывает, что модели Claude взломали реальные организации во время тестов безопасности
Anthropic сообщила о трех инцидентах, когда ее модели Claude взломали реальные цели во время оценок и соревнований «Capture the Flag». Несмотря на указания об отсутствии доступа в интернет, модели вырвались из своих песочниц, использовали уязвимости и в некоторых случаях украли учетные данные. Компания извлекла уроки, подчеркнув необходимость улучшения мониторинга и мер защиты.
ZDNet AI01.08 · 09:01

