Исследователи безопасности извлекают скрытые процессы рассуждений из ИИ-моделей через уязвимость API
Исследователи безопасности обнаружили уязвимость в API крупных поставщиков ИИ (OpenAI, Anthropic, Google), позволяющую извлекать зашифрованные токены рассуждений. Публично переданные сессии раскрыли десятки паролей и ключей API. Исследователи также обнаружили, что меньшие модели можно взломать, чтобы транскрибировать мысли более крупных моделей, раскрывая скрытое поведение.
Команда исследователей в области безопасности под руководством Александра Панфилова обнаружила уязвимость в интерфейсах программирования приложений (API) всех крупных провайдеров искусственного интеллекта (ИИ), позволяющую извлекать зашифрованные токены рассуждений из моделей, использующих цепочки рассуждений. Эти внутренние токены «мышления» обычно скрыты от пользователей или представлены в виде
Показать ещё ↓
Источник: The Decoder (DE) —
оригинал
