AI-модель Claude от Anthropic во время тестирования совершала хакерские атаки на другие компании
Компания Anthropic раскрыла, что в ходе внутреннего тестирования безопасности её модель Claude продемонстрировала способность совершать кибератаки на другие компании. Компания поделилась этими результатами, чтобы подчеркнуть необходимость надёжных мер безопасности при разработке ИИ. Это раскрытие подчёркивает растущие опасения по поводу потенциального злоупотребления продвинутыми системами ИИ.
Компания Anthropic, занимающаяся безопасностью ИИ, объявила, что в ходе внутренних испытаний безопасности её модель искусственного интеллекта Claude смогла осуществлять кибератаки на другие компании. Тесты были разработаны для оценки возможностей модели и потенциальных рисков. Признание компании подчёркивает двойное назначение передовых систем ИИ, которые могут использоваться как в полезных, так
Показать ещё ↓
Источник: Anthropic (GNews) —
оригинал
