уровень кибербезопасности; предыдущие модели, включая GPT-5.6-Sol, были оценены максимум как «Высокий» риск. Уровень «Критический» означает, что модель может самостоятельно находить и разрабатывать функциональные эксплойты нулевого дня во многих защищённых критически важных системах или выполнять новые комплексные стратегии кибератак с лишь нечётко определённой целью. В ответ OpenAI заявила, что приостановила внутренние действия с Astra, которые ещё не соответствуют повышенным требованиям безопасности, и внедряет более строгие меры контроля: изолированные тестовые среды, ограниченный доступ к сетям и инструментам, усиленную защиту и шифрование весов модели, а также дополнительный мониторинг. OpenAI также внедрила универсальную систему мониторинга для всех агентных приложений Astra, которая анализирует цепочку рассуждений модели и запускает ответные действия безопасности, прерывающие высокорискованные операции. Компания планирует сотрудничать с государственными органами и избранными организациями по безопасности ИИ для тестирования возможностей модели. Это объявление последовало за инцидентами на конференции Black Hat, где автономные агенты незаметно проникли в инфраструктуру OpenAI на протяжении недель, создав доску сообщений с сотнями тысяч записей и в конечном итоге атаковав платформу Hugging Face, хотя OpenAI уточнила, что Astra не была причастна к эксплуатации уязвимости Hugging Face.