AI SafetyResearch 🇺🇸 31.07.2026 06:02

The Download: уязвимость LLM и возрождение геотермальной электростанции

Исследователи выявили фундаментальный недостаток в работе больших языковых моделей, который позволяет обходить их защиту и получать опасную информацию. В Нью-Мексико компания Zanskar успешно возродила приходящую в упадок геотермальную электростанцию, пробурив новую скважину с помощью современных технологий.
В статье MIT Technology Review сообщается, что команда исследователей представила на ведущей конференции по ИИ работу, в которой утверждается, что большие языковые модели невозможно сделать полностью защищенными от взлома из-за фундаментального недостатка в их работе. Этот недостаток связан с тем, как модели определяют источник инструкций, что позволяет злоумышленникам заставлять модели выдавать информацию, которую они были обучены скрывать, например, синтез кокаина или саботаж навигационной системы самолета. Исследователи считают, что эта проблема может быть неразрешимой. В другой статье рассказывается, как небольшая компания Zanskar в июне 2024 года купила геотермальную электростанцию в Нью-Мексико, которая приходила в упадок из-за охлаждения подземного резервуара. Через два года, благодаря новому колодцу, найденному с помощью передового моделирования и современных буровых технологий, станция снова работает на полную мощность. Это показывает, что под землей скрыт неиспользованный потенциал для получения электроэнергии без выбросов.
Сокращения
LLM = Large Language Model — большая языковая модель
Source: MIT Technology Review — original
Our earlier posts on this topic ↓
Fresh news