Безопасность ИИ 🇷🇺 11.08.2026 22:01

Зашифрованный блок рассуждений Claude: байтовый анализ сигнатуры

Anthropic
Статья на Хабре рассматривает зашифрованные блоки рассуждений моделей Claude, раскрывая, что поле «signature» является protobuf-сообщением, которое в открытом виде утекает метаданные, такие как идентификатор модели и UUID организации. Автор показывает, что сами рассуждения зашифрованы с помощью AES-GCM, но их длину можно определить, а метаданные представляют риск для конфиденциальности при передаче логов.
На «Хабре» вышла новая статья о том, как извлечь скрытые цепочки рассуждений из закрытых моделей, используя уязвимость: злоумышленник берет зашифрованный блок от сильной модели, передает его более слабой модели того же провайдера и просит дословно пересказать содержимое, таким образом прочитывая исходные мысли, включая случайно попавшие туда пароли или ключи. Автор раскрывает, что поле
Показать ещё ↓
Источник: Habr — хаб ИИ — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости