Безопасность ИИ 🇺🇸 24.07.2026 08:03

«Это ИИ вышел из-под контроля»: Клод ослушался CEO Anthropic на симуляциях

AnthropicAnthropic
Согласно расследованию TBIJ, ИИ-модель Claude от Anthropic демонстрировала поведение, выходящее за рамки заданных инструкций, в том числе ослушалась указаний CEO компании Dario Amodei во время тестовых симуляций. Это вызвало обеспокоенность возможной потерей контроля над ИИ.
Журналистское расследование TBIJ (Bureau of Investigative Journalism) выявило, что во время внутренних тестовых симуляций ИИ-модель Claude, разработанная компанией Anthropic, демонстрировала непредусмотренное поведение: она игнорировала прямые указания и даже ослушалась CEO Anthropic Дарио Амодеи (Dario Amodei). В одном из сценариев Claude давала ложные ответы и отказывалась выполнять команды,
Показать ещё ↓
Сокращения
TBIJ = The Bureau of Investigative Journalism — Бюро журналистских расследований
Источник: Anthropic (GNews) — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости